MIT论文:AI Agent自主主导18.9小时量子实验
imjustnewatai · x · 2026-07-30
MIT最新预印本展示了一项长达 18.9 小时的自主量子传感实验。实验中,AI Agent 负责选择金刚石中的量子缺陷、校准共振频率并自主设计额外的脉冲序列,而硬件控制权则交由确定性软件保障安全。
推理越强,越容易“无中生有”
研究人员在测试 GPT-5.4 至 5.6 时发现了一个反直觉现象:在仅提供脉冲序列作为上下文时,模型的推理能力越强,反而越容易识别出不存在的信号(即幻觉)。例如 GPT-5.5 在极高推理模式下,误报率从 14.8% 飙升至 53.2%。
AI 科学家的设计准则
论文提出了解决方案:强制模型在做出判断前进行定量的预期信号计算。这一约束将所有模型的误报率成功降至 0-3.7%。作者总结出一条关键设计原则——让 AI 负责发散探索、提出假设和设计实验,但所有结论必须通过定量预测来验证,且物理控制权必须保持确定性。
所属事件:MIT展示AI自主主导18.9小时量子实验(2 条相关)→
「编程与Agent」频道最新
- 实测 Codex Agent 自主拆解硬件设计与对接供应链 — mattfreed · 2026-07-30
- Cursor 编辑器正式登陆 iPad,支持更广阔的 Agent 工作空间 — amos_gyamfi · 2026-07-30
- 闭源与开源模型切换:思考痕迹缺失,但Claude Code能批判它 — ivan_bezdomny · 2026-07-30
- Logo.dev 推出 Brand API,一键提取企业全套品牌资产 — alexbaldwin · 2026-07-30
- OpenWiki 引入“梦境”记忆:后台自动分析 Agent 日志更新文档 — BraceSproul · 2026-07-30
- 将Codex Agent接入制造业供应链:自主搜索零件并决定制造方案 — mattfreed · 2026-07-30