类库
› HumanCLAW
Human-CLAW/HumanCLAW
HumanCLAW是一个评估视觉语言模型(VLM)行动智能的框架,将决策与底层运动执行解耦。它提供包含1218个长程任务的基准测试,用于衡量模型在室内场景中导航和交互的能力,揭示当前模型缺乏具身自我意识的问题。
HumanCLAW是一个评估视觉语言模型(VLM)行动智能的框架,将决策与底层运动执行解耦。它提供包含1218个长程任务的基准测试,用于衡量模型在室内场景中导航和交互的能力,揭示当前模型缺乏具身自我意识的问题。