用三个前沿模型给 50 位科技领袖的思考力打分,LeCun 居首

tonygwu · x · 2026-10-01

作者用 Fable、Astra 和 Gemini 三个模型作为独立评委,基于 653 份逐字转录稿(共约 880 万词)的播客、访谈和演讲,对 50 位科技领袖按「洞察力(45%)、技术与行业深度(35%)、清晰度(20%)」三项加权评分。结果显示 Yann LeCun 排第一,Jeff Bezos 第二,Tim Sweeney 第三,Marc Benioff 垫底(第 50)。

方法论上做了不少认真处理:三位评委独立按 15 项子标准打分,评委间一致性达 0.854;分差小于 4.3 分视为统计意义上的并列;每个分数都附带评委的书面理由和引用证据。代码、评分标准和测试已在 GitHub 开源。

所属事件:三模型盲评 880 万词访谈,LeCun 洞察力居首(3 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →