METR 负责人:模型 2027 年 8 月前或达人类研究员水平
theamberyang · x · 2026-09-15
METR CEO Rayan Krishnan 在 Bloomberg 采访中谈及 AI 进展与独立评测的要点:
- 我们造 AI 的能力已超过理解它的能力,加大测试/评测的投入比减速开发更重要
- METR 的 RSI 指数预测:模型在其测试任务上或于 2027 年 8 月前匹配人类研究者水平;嵌入模型的内部评测者可给出更准确估计
- 公开的冲突之下是合作:实验室、政策制定者与企业都想要更好的证据,协调是可能的
- 独立性有代价:METR 拒绝过会损害独立性的合同,认为做测试的机构不应同时卖解决方案
- 评测应靠技术扩展规模,若沦为在位实验室的官僚护城河即告失败;市场化评测也有其位置
「漫话AGI」频道最新
- ORQA 论文:116 个职业实测 LLM 专业知识,前沿模型仅得约六成 — soumitrashukla9 · 2026-09-15
- OpenAI 能力研究员 Dan Selsam 公开发表个人 AI 风险声明 — DKokotajlo · 2026-09-15
- 果蝇全脑连接组新发现:靠突触权重快更新导航,LLM 不会这招 — tszzl · 2026-09-15
- 著名生物学家 Szathmáry:AGI 繁殖速度堪比进化失控风险 — danfaggella · 2026-09-15
- 调查显示亚洲 AI 研究者对风险的担忧反而高于西方同行 — KatjaGrace · 2026-09-15
- 艺术家 Sterling Crispin 站队奇点派:造思考机器是人性的庆祝 — sterlingcrispin · 2026-09-15