Karpathy实测 Claude Opus:2小时写5500行代码渲染3D版魔戒

andrewchen · x · 2026-08-02

Andrej Karpathy 转发并探讨了 LLM 评测方式的演进。他指出,我们正在超越用“生成一个骑自行车的鹈鹕 SVG”来测试模型的时代。

为了探索模型的长任务能力,他给 Claude 3 Opus 提供了《魔戒》的开头段落、100 万 token 预算(约 10 美元),要求其用 Three.js 渲染出故事场景。Opus 连续运行约 2 小时,输出了 5500 行代码,通过程序化方式成功渲染了故事画面。Karpathy 感叹,模型需要自行计算并编排 (x,y,z) 坐标来放置多边形资产,还能编写代码完成所有动画,最终能跑出效果令人惊叹。这也展示了 LLM 带来的新范式:那些人类根本没有耐心去手工编写的超长定制化代码,现在交给 LLM 几乎可以“免费”完成。

所属事件:Karpathy实测大模型:2小时烧10美元写5500行代码渲染3D魔戒(6 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →