vibe coding 造出 5 万行 PR,但没人能验证它们真能跑
srchvrs · x · 2026-09-18
作者 srchvrs 发推线程质疑当前 AI 编码的乐观叙事:用 Codex、Claude Code 等工具,开发者确实能产出 1 万到 5 万行的巨型 PR,代码产量爆炸,连 Boris Cherny、Dario Amodei、Sam Altman 都在鼓掌,仿佛软件工程已被解决。
但他指出关键 catch:没有人也没有任何东西能真正验证这些巨型 PR 是对的。
- 测试管线被 vibe-coded 的测试主导,而这些测试往往是生成实现代码的同一个模型写的,为的是「通过测试」——自己出题自己判卷
- 严肃的集成测试、类生产环境测试、端到端验证?「也许最终会有」
- 上线的「神奇包」看似能跑,但前提是有人全程手把手盯着:现场调试、随手打补丁、处理代码撞上现实后冒出的各种意外
「编程与Agent」频道最新
- MiniMax 开源 Code CLI v0.4.12,FrontierHarness 评测 SOTA — MiniMax_AI · 2026-09-18
- MiniMax 开放 Code CLI 编码智能体工具,招募 Agent 范式探索 — MiniMax_AI · 2026-09-18
- AWS 发布六个开源 Skills,让编码代理正确部署 Hugging Face 模型 — AWS ML Blog · 2026-09-18
- 三名普通开发者用 Claude 和 Codex 串起 6 个漏洞完成攻击 — xennygrimmato_ · 2026-09-18
- 科研 agent 框架 Outerloop 0.2.0:持久状态与统一消息收件箱 — mengyer · 2026-09-18
- Astra 演示:一句话让 Blender 帆船变成带水模拟的浏览器体验 — Dimillian · 2026-09-18