量子编程成 vibe coding 盲区:编译通过不等于电路正确
AryHHAry · x · 2026-09-19
作者分析为什么 vibe coding 在量子计算领域失效:web 开发中「能跑」≈「正确」(错误可见、可贴 traceback),而 Qiskit/PennyLane 中电路能编译、直方图整洁、VQE loss 下降,unitary 却仍可能是错的——坏的不是语法而是语义,且没有红灯提示。
- QuanBench+ (2026):one-shot 最佳仅 Qiskit 59.5%、PennyLane 42.9%;5 轮修复后为 83.3% 与 66.7%,剩余失败是逻辑错误而非括号问题。
- QuantumKatas:Opus 级与 Codex 级模型达 75–83%,主导失败类型仍是 Assertion Error——代码合法但量子态不对。
- 根因:vibe coding 依赖「廉价且诚实的反馈」,量子计算给的是「昂贵且沉默」的反馈——模拟器会纵容、硬件拒绝过时 API、梯度可在不观测任何东西的 ansatz 上「学习」。
- 换更贵的模型只改变错误分布,解决不了 fidelity、provenance、脱离同一厂商无法复现这第二层问题。
结论:如果电路证据只在 chat 会话打开时才可信,那不是智能的提升,而是权威从量子力学转移到了自动补全。
「编程与Agent」频道最新
- IBM 开源文档解析库 Docling 破 6.6 万星,专供生成式 AI 吃文档 — docling-project · 2026-09-19
- Codex-X 开源:给 OpenAI Codex 桌面端装上可视化管理面板 — yynxxxxx · 2026-09-19
- 「让 Agent 随便跑」一小时后:AI 圈疯传的编码 Agent 翻车梗 — charles_irl · 2026-09-19
- Claude Code 2.1.277 支持 AGENTS.md,无 CLAUDE.md 时自动读取 — eyishazyer · 2026-09-19
- 开源 Jev-cu:给 Codex 装上更快的 computer use,只传文字不传截图 — alexcovo_eth · 2026-09-19
- 实测称 Jev 处理 384 条新闻仅花 $0.19,比 Claude Opus 5 便宜约 390 倍 — airesearch12 · 2026-09-19