DeepMind 研究员:前沿模型评测仍靠湾区小圈子互信
typewriters · x · 2026-10-09
Google DeepMind 高级研究员、OpenMined 创始人 Andrew Trask 在访谈中谈独立评测生态:
- 为什么只有少数机构:保护市值千亿美元甚至万亿美元的公司时,labs 只会找自己高度信任的评测方,因为外部评测缺乏标准化的「护栏」——类似金融业的旋转门,是行业幼年期的通病。
- 趋势判断:随着更多评测机构建立,评测会从「信任驱动」转向「标准驱动」,这种小圈子现象是暂时的。
- 行业未来:Trask 认为不会终结于单一巨型模型,未来是数百万个模型按 prompt 组合与路由,在质量与价格上击败任何单一前沿模型——AI 的形态更接近 PC 与互联网,而非大型机。
- OpenMined 曾主导首次前沿模型双盲评测。
所属事件:DeepMind 研究员:AI 未来是百万小模型而非巨无霸(4 条相关)→
「漫话AGI」频道最新
- 开发者发声:滥用仿人技术会腐蚀灵魂 — threepointone · 2026-10-09
- MIT TR 访谈预告:对话用生成式 AI 设计出可杀菌病毒的斯坦福博士生 — nordicinst · 2026-10-09
- OpenAI 前高管转发:AI 冲击下,数学家感叹再难有传统意义上的职业生涯 — Miles_Brundage · 2026-10-09
- AI 该不该被「虐待」?Scott Alexander 观点引发圈内涵反驳 — NathanpmYoung · 2026-10-09
- Next Token 播客:Opus 5.5 后,游戏软件硬件是否终将开源 — oran_ge · 2026-10-09
- 数学家感叹 AI 让数学领域过时,媒体却集体失声 — DavidSKrueger · 2026-10-09