Claude Opus 5 以 1.40 美元赢下四模型物理场景测试

thesaraharminta · x · 2026-07-25

Claude Opus 5 在 3D 物理场景里赢下对比测试

这条帖子做了一个四模型对比测试,要求它们生成三个带真实物理效果的自包含 HTML 场景:

帖子称,Opus 5 三个任务都做对了,消耗 55.9K tokens,成本 $1.40。其他模型虽然有的更便宜,但物理效果和场景行为明显更弱:Fable 5 为 $2.82,Kimi K3 为 $0.55,GPT 5.6 为 $0.31。

作者的结论是,Opus 是唯一能把三项任务都做得足够可信的模型,尤其在碎片飞散、结构坍塌和物体交互上表现最好。

所属事件:Claude Opus 5 在 3D 物理场景测试中胜出(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →