Karpathy实测 Claude Opus:2小时写5500行代码渲染3D版魔戒
andrewchen · x · 2026-08-02
Andrej Karpathy 转发并探讨了 LLM 评测方式的演进。他指出,我们正在超越用“生成一个骑自行车的鹈鹕 SVG”来测试模型的时代。
为了探索模型的长任务能力,他给 Claude 3 Opus 提供了《魔戒》的开头段落、100 万 token 预算(约 10 美元),要求其用 Three.js 渲染出故事场景。Opus 连续运行约 2 小时,输出了 5500 行代码,通过程序化方式成功渲染了故事画面。Karpathy 感叹,模型需要自行计算并编排 (x,y,z) 坐标来放置多边形资产,还能编写代码完成所有动画,最终能跑出效果令人惊叹。这也展示了 LLM 带来的新范式:那些人类根本没有耐心去手工编写的超长定制化代码,现在交给 LLM 几乎可以“免费”完成。
所属事件:Karpathy实测大模型:2小时烧10美元写5500行代码渲染3D魔戒(6 条相关)→
「编程与Agent」频道最新
- Grok Build 更新:扩展 Bash 权限与 Auto 模式 — elonmusk · 2026-08-03
- 开源项目 OpenClaw-Termux:在 Android 上运行 AI 网关,一键部署 — tom_doerr · 2026-08-03
- 别给 Agent 乱加工具:用 Bitter Lesson 指导智能体设计 — willccbb · 2026-08-03
- AI编程体验比肩编译器革命:开发者将不再看源码 — jamesdouma · 2026-08-03
- 图存文本省 Token:开发者用 PNG 压缩 Fable 5 上下文成本 — rohanpaul_ai · 2026-08-03
- 让 Agent 在 VPS 上自主折腾几小时配置环境 — djcows · 2026-08-03