个人 Blender 基准:GPT-6-Astra 一发脚本效果远超此前测试模型
Gruku · reddit · 2026-09-08
一位开发者受 MineBench 启发做了个人 Blender 基准项目,测试 LLM 一次性编写 Python 脚本生成 3D 场景的能力。最新测试 GPT-6-Astra 的结果与其他已测模型差距明显;在 Blender MCP 多轮模式下效果更 impressive,但成本较高未大规模测试。作者认为单次「写个视觉上有意思的东西」已接近该测试形式的上限,下一步将测试 game-ready 资产与真实生产任务。结果与投票在 blenderbench.realityreprojector.com。
「模型」频道最新
- IFM 发布 K2-Horizon 系列:含 375B A23B 巨型 MoE — PhilippeEiffel · 2026-09-08
- davinci-002 将于 9 月 28 日停服,开发者复刻初代 GPT 体验作纪念 — cephaloform · 2026-09-08
- 法国创业者点评模型座次:ChatGPT 被低估,Gemini 已趴窝 — firstadopter · 2026-09-08
- 实测吐槽:Astra 写代码被指过度炒作,反复循环不精准 — Nevetsny · 2026-09-08
- 工程师批 Astra 距 AGI 宣传甚远:像老虎机式随机好用 — joshua_saxe · 2026-09-08
- 模型 Blender 实力差距引热议:训练数据没见过,再强的模型也画不出来 — bookwormengr · 2026-09-08