WetLabs 基准测试机器人能否加速科学实验室:Astra 领跑,Opus 5.5 逼近

philhchen · x · 2026-09-26

Mecka 团队(Josh 与 @jasontheutopian)发布 WetLab Benchmark,用 9 项由易到难的关键湿实验室任务、每个任务让 3 个领先模型各执行 20 次,检验「机器人是否准备好加速科学实验室」。结果显示 Astra 领先,但 Opus 5.5 等最新模型(Astra/Opus-5.5)进步呈阶梯式跃升,使这类基准愈发重要。转发者称 Mecka 组建了极强的机器人团队。

所属事件:WetLabs 基准发布:实测机器人能否加速湿实验科研(2 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →