SWE 感叹模型越强活越难:Opus 4.6 削弱前才是最佳编码模型
LouMM · x · 2026-09-15
安全工程师 Dave(@HackingDave)提出一个不受欢迎的观点:被削弱前的 Opus 4.6 是他心目中 SWE 场景的最佳模型。他认为现在的模型虽然在概念性架构设计、UI 设计等方面更好,但常常过度制造复杂度、走捷径、实现和测试不完整、反复重构返工,给出的回复也更难辨认和排查。
他由此推断:随着模型变得更聪明,"更好"并不会让软件工程师的工作变得更容易、更快或更简单。转发者 LouMM 补充认同:真正持续重要的是 orchestrator(编排者)——来自驾驭这些模型的『司机』的经验判断,将继续带来价值,短期内不会改变。
「编程与Agent」频道最新
- Qdrant 实测:稠密向量+BM25+SPLADE 混合检索 SEC 财报 — qdrant_engine · 2026-09-15
- 切回 Opus 后 agent 近乎复刻 ElevenLabs 广告,几乎难辨真伪 — austin_malerba · 2026-09-15
- 让 GPT-6 Astra 把 Ruby on Rails 应用迁到 Hugo 的冒险 — kshirinkin · 2026-09-15
- Matt Pocock 推出 /retro:把编码规范问题固化为 lint 与 CI 检查 — mattpocockuk · 2026-09-15
- Codex 沙箱再被攻破:开源 CLI 与 Rust 闭源侧均现逃逸,官方已修复 — EdenEmarco177 · 2026-09-15
- 倒着造谜题:滑铁卢大学发布 2 万题 ORBIT 数据集训练搜索 agent — CShorten30 · 2026-09-15