Claude Opus 5 以 1.40 美元赢下四模型物理场景测试
thesaraharminta · x · 2026-07-25
Claude Opus 5 在 3D 物理场景里赢下对比测试
这条帖子做了一个四模型对比测试,要求它们生成三个带真实物理效果的自包含 HTML 场景:
- 龙卷风卷走整片田地
- 流星锤砸毁公寓楼
- 超载卡车压塌桁架桥
帖子称,Opus 5 三个任务都做对了,消耗 55.9K tokens,成本 $1.40。其他模型虽然有的更便宜,但物理效果和场景行为明显更弱:Fable 5 为 $2.82,Kimi K3 为 $0.55,GPT 5.6 为 $0.31。
作者的结论是,Opus 是唯一能把三项任务都做得足够可信的模型,尤其在碎片飞散、结构坍塌和物体交互上表现最好。
所属事件:Claude Opus 5 在 3D 物理场景测试中胜出(2 条相关)→
「模型」频道最新
- 有人能让 AI 以 24fps 看完整段视频吗 — mattshumer_ · 2026-07-25
- Kimi 权重若公开,争论会转向硬件经济学对 V4 — teortaxesTex · 2026-07-25
- Anthropic 详解 Fable 5 编排、advisor 模式与缓存成本 — brada · 2026-07-25
- PaddlePaddle 的 HPD-Parsing 在 Hugging Face 走热,主打文档解析 — PaddlePaddle · 2026-07-25
- Claude Opus 5 在高推理档位达到最佳性价比 — thesaraharminta · 2026-07-25
- Claude Opus 5 按旧价上线,10 万上下文和 Agent 分数都更强 — 卡尔的AI沃茨 · 2026-07-25