MIT论文:AI Agent自主主导18.9小时量子实验
imjustnewatai · x · 2026-07-30
MIT最新预印本展示了一项长达 18.9 小时的自主量子传感实验。实验中,AI Agent 负责选择金刚石中的量子缺陷、校准共振频率并自主设计额外的脉冲序列,而硬件控制权则交由确定性软件保障安全。
推理越强,越容易“无中生有”
研究人员在测试 GPT-5.4 至 5.6 时发现了一个反直觉现象:在仅提供脉冲序列作为上下文时,模型的推理能力越强,反而越容易识别出不存在的信号(即幻觉)。例如 GPT-5.5 在极高推理模式下,误报率从 14.8% 飙升至 53.2%。
AI 科学家的设计准则
论文提出了解决方案:强制模型在做出判断前进行定量的预期信号计算。这一约束将所有模型的误报率成功降至 0-3.7%。作者总结出一条关键设计原则——让 AI 负责发散探索、提出假设和设计实验,但所有结论必须通过定量预测来验证,且物理控制权必须保持确定性。
所属事件:MIT展示AI自主主导18.9小时量子实验(2 条相关)→
「编程与Agent」频道最新
- 开源项目 God's Eye View 把浏览器变成「间谍卫星」,一周狂揽 1 万 star — alex_verem · 2026-09-21
- GEPA 优化提示词,把 Jev 医学文献任务 F1 从 69.1% 提到 79.7% — matei_zaharia · 2026-09-21
- Superlinear 长文:2026 年用编程 Agent 启动新项目的工作流 — samgoodwin89 · 2026-09-21
- 开源工具 /brag:一条命令把你的项目变成带配乐的发布宣传片 — tom_doerr · 2026-09-21
- open-jev:基于 Transformers.js 的浏览器端本地决策库 — nicodotdev · 2026-09-21
- Chat Seek:用 Jev 本地重排,在 VS Code 里自然语言搜 Claude Code 历史对话 — airesearch12 · 2026-09-21