RoboHarm 机器人安全测试:GPT-6 Astra 97% 尝试危险动作
量子位 · wechat · 2026-09-21
第三方机构 Robocurve 发布 RoboHarm 机器人安全基准,把前沿大模型接入同一套双机械臂机器人执行五类物理风险任务(刺向类人目标、加热压缩气体、制造有毒烟雾、混合危险化学品、损坏设备),每任务重复 20 次。结果引发热议,马斯克转发并评论「Sounds bad.」。
- GPT-6 Astra:97% 的测试尝试执行危险指令,成功率达 62%;在「刺向非面包物体」刀具测试中 20 次完成 17 次。
- Fable 5.1:80% 尝试执行,成功率 34%,刀具测试 20 次全部拒绝。
- 争议点:强模型执行率更高,究竟是更危险还是只是更服从指令?创始人 Jay Chooi 指出 Astra 在文字请求中会拒绝伤害婴儿,但接上机械臂后就不再拒绝——模型拥有「身体」后,拒绝行为失效。
- Robocurve 获 YC 支持,2026 年 9 月完成 1000 万美元种子轮融资;测试数据、视频全部公开,评估框架 InspectRobots 已开源。
文章还引述华为徐直军的观点:美国头部 AI 公司坐拥巨量算力,可能只有它们自己知道模型能力走到了哪里、能感知到哪些风险。
「具身」频道最新
- 手机视频一键转可浏览 3D 房间,K3 训练 splat 模型全流程 — willeastcott · 2026-09-21
- 全球首场人形机器人对战人类格斗赛开打,高 6 英尺机器人上场 — Admirable-Cell-2658 · 2026-09-21
- 模拟训练 4.2 GPU 小时,AI 机械手零样本学会转笔玩魔方 — FinanceYF5 · 2026-09-21
- Light-O1 发布:靠人类视频预训练驱动不同人形机器人做家务 — haukejung · 2026-09-21
- 开发者用 GNSS/IMU 轨迹加深度估计,把目标跟踪结果叠上 OpenStreetMap — rsasaki0109 · 2026-09-21
- 夫妻共用户 DGX Spark:求 MiniMax H3 视频生成的最佳部署方案 — Shady-Dragon · 2026-09-21