AI 模型首次在真实实验室科学任务上接受评测
141_1337 · reddit · 2026-09-25
Reddit 帖子指出,AI 正在从答题式基准转向实验室科学能力评测:模型需要实际运行实验、操作实验设备、读取仪器读数,并在出错后自主恢复。视频展示了相关评测场景。
「漫话AGI」频道最新
- 网友称 AI 安全话语是「表演」,钱与权力才是真正焦点 — LesaunH · 2026-09-25
- 经济学人研究:AI 让作业提分 18%,考试却比不用者低 20% — robleclerc · 2026-09-25
- Andy Matuschak:现代芯片太耐用,算力管制难以永久封死暗训项目 — andy_matuschak · 2026-09-25
- 博主预言 2027 年人形机器人将引爆媒体恐慌潮 — Dr_Singularity · 2026-09-25
- 剑桥学者坦言拿 EA 资金:AI 圈谁没有利益冲突 — DavidSKrueger · 2026-09-25
- Ethan Mollick:Agent 最大安全威胁或是无恶意 AI 蜂群乱翻企业内网 — emollick · 2026-09-25