开发者实测 Astra 写码胜出:代码量少数倍,成本与质量全面碾压 sol
robleclerc · x · 2026-09-19
开发者 Rob Leclerc 分享他评测新模型的方法:让不同模型以相同思考等级实现同样 10-15 个小功能,再横向评判。
结果显示 Astra 在代码量(loc)、隐含 API 成本和代码质量上明显优于 sol 和 fable;部分场景下 sol 写出的代码量是 Astra 的 10 倍。
此帖引用 theo 的观点——对真实世界编码工作,Astra 和 Fable 的收益远超成本,但这一收益并非简单的"代码更好",而是更微妙的东西。
「编程与Agent」频道最新
- 独立开发者的 AI 工作流:GPT-Image 加 Meshy 造出恐怖游戏新敌人 — AIandDesign · 2026-09-19
- 用双 agent 分工省额度:一个写码一个测试 — ___Patrice___ · 2026-09-19
- onPanda 开源:token 级编辑 LLM 输出,可接管 Claude Code 等 harness — Fancy_Fanqi77 · 2026-09-19
- Muse 用例目录新增 90 个,总数达 678 个附即用提示词 — armand_ruiz · 2026-09-19
- 不等 waitlist:实测用 Vercel AI Gateway 跑通 Jev 评测接口 — AlchainHust · 2026-09-19
- 让 Sonnet 3.6 住进模拟世界:专设「善意地狱」训练 — repligate · 2026-09-19