Vibe coding 距生产级软件还很远:长程能力差、前端质量低是硬伤
aidenybai · x · 2026-10-02
Gabe Greenberg 回应「非工程师 vibe coding 能否做出生产级软件」的讨论,给出三大差距:
- 长程工作能力不足:模型还做不好长周期任务,而软件开发本质上就是长程工作
- 输入质量决定输出质量:懂软件架构的人能给出更合理的规划和大小合适的 prompt,从而获得更好产出
- 前端代码质量差距巨大:以 ReactBench 为例,模型能通过现有基准的全部测试,写出的 React 代码却在生产环境翻车——测试只验证行为,覆盖不了性能、可访问性和质量问题。ReactBench 榜首 GPT 5.6 Solmax 的 Pass@1 也仅 47%。
结论:代码生成再便宜再好,缺乏架构理解与长程执行能力的非工程师仍难以做出可规模化的生产级软件。
「编程与Agent」频道最新
- 研究者用免费开源工具做幻灯片,摆脱 PowerPoint 与 AI 设计俗套 — Afinetheorem · 2026-10-02
- 用 Claude 在 Cursor 里做出一支互联网全史视频 — prasenx · 2026-10-02
- Opus 5.5 借浏览器即兴联弹 Strudel 实时编程音乐,惊艳网友 — repligate · 2026-10-02
- Skyvern 3.0 重建后登顶 Odyssey 榜单,浏览器 Agent 得分 90.5% 保持开源 — ycombinator · 2026-10-02
- 换模型前如何测试 AI Agent?开发者聚焦静默回归与工具调用验证 — Fun_Employment6042 · 2026-10-02
- Databricks 推出 ai_decide:毫秒级结构化决策,比 LLM 更快更省 — matei_zaharia · 2026-10-02