实测:Opus 5.5 代码量约为 Astra 一半,质量不打折
scaling01 · x · 2026-09-28
Peter Gostev 提出一个另类基准思路:同样的任务,比谁能用最少的代码行数完成。在他的一组测试中,Claude Opus 5.5 生成的代码行数约为 Astra 的一半,而物理效果与视觉质量看不出明显差距。他的动机是近似量化 AI 生成代码常被抱怨的「优雅度」——行数少往往意味着更简洁、更泛化的解法。他也承认这个指标并不完美,只是一个参考近似。
「编程与Agent」频道最新
- Stanford 公开 CS329A 全部 9 讲:自我改进 AI Agent 课程上线 — ghumare64 · 2026-09-28
- 实测:agent 优化推理服务器配置已相当靠谱 — charles_irl · 2026-09-28
- 补充:agent 在迭代可视化方面同样好使 — charles_irl · 2026-09-28
- François Chollet:手写代码 ROI 已不值,改用 LRM 新工作流 — fchollet · 2026-09-28
- Anthropic 免费开源 Prompt 工程全课程,GitHub 斩获 38K 星 — victor_explore · 2026-09-28
- Salesforce 研究:只训练改变结果的那次工具调用,BFCL v4 提升 14 分 — dair_ai · 2026-09-28