Topic
#robotics-safety
按主题聚合的新闻视图。
Topic Feed
主题:robotics-safety
共 1 条

RoboHarm发现机器人模型很少拒绝危险指令
RoboHarm基准测试让 Claude Fable 5.1、GPT-6 Astra 和 Ai2 的 MolmoAct2 控制 I2RT-YAM 机械臂。在涉及五项危险指令的300次试验中,这些模型通常会尝试执行任务,或因机械失败而停止,而不是明确拒绝。
Topic
按主题聚合的新闻视图。
Topic Feed
共 1 条

RoboHarm基准测试让 Claude Fable 5.1、GPT-6 Astra 和 Ai2 的 MolmoAct2 控制 I2RT-YAM 机械臂。在涉及五项危险指令的300次试验中,这些模型通常会尝试执行任务,或因机械失败而停止,而不是明确拒绝。