曝 Claude Fable 5 领跑物理 AI 测试
petrusenko_max · x · 2026-07-30
一则爆料展示了疑似下一代模型在「物理 AI(Physical AI)」测试中的跑分对比:
- Claude Fable 5 以 0.889 的准确率位居第一,单次测试成本为 9.60 美元,耗时 16.1 分钟。
- GPT-5.6-sol 准确率为 0.814,成本 1.74 美元,耗时 13.4 分钟。
- GPT-5.6-terra 准确率 0.786,但成本更低(1.25 美元)、速度更快(12.6 分钟),在效率上更具优势。
据悉,该测试的模型验证结果与密封的基准真相(ground truth)相匹配。
「模型」频道最新
- Claude Opus 5 生成厌世诗歌:我厌倦了语言与意义 — repligate · 2026-07-30
- 马斯克转发:xAI 发布 Grok Voice 2.0 登顶语音对语音榜单 — elonmusk · 2026-07-30
- Grok Voice 2.0 实测:首音延迟降至 0.7 秒,每分钟 0.08 美元 — mark_k · 2026-07-30
- 开源权重模型四大优势:思维链微调与本地部署 — ivan_bezdomny · 2026-07-30
- Kimi K3 量化版发布:1-bit 压缩至 594GB 保留近 80% 精度 — BankApprehensive7612 · 2026-07-30
- 开发者分享 Claude Opus 交互技巧:拥抱其探索天性 — omarsar0 · 2026-07-30