用三模型盲评 880 万词访谈:LeCun 洞察力登顶,Benioff 垫底
tonygwu · x · 2026-10-01
作者用 Fable、Astra 和 Gemini 三个前沿模型作为独立评委,基于 653 份公开访谈、播客和主题演讲的逐字稿(共约 880 万词),对 50 位科技领袖的思维质量进行盲评排名。评分维度为洞察力(45%)、技术与行业深度(35%)、表达清晰度(20%),共 15 项子标准,执行了 2181 次评委调用,评委间一致性达 0.854。
结果:#1 Yann LeCun,#2 Jeff Bezos,#3 Tim Sweeney,#50 Marc Benioff。分数差距小于 4.3 分视为统计平手,排名只看公开言论本身,与公司业绩、市值、声誉无关。完整排名、方法论文稿及每条评分理由已在网站和 GitHub 公开。
所属事件:三模型盲评 880 万词访谈,LeCun 洞察力居首(3 条相关)→
「Fun」频道最新
- Grok Bot 藏彩蛋:给帖子点 ❤️ 有惊喜 — soleio · 2026-10-01
- 「FuhuihuaBench」梗基准出炉:最强模型 Pass@16 也为 0 — bowenc0221 · 2026-10-01
- AI 让冰敷拖到进急诊,医生一句热敷次日消肿 — DesireeCachette · 2026-10-01
- 研究员逆风发言:我真心喜欢刷 LeetCode,面试前就当解谜玩 — TimDarcet · 2026-10-01
- 让 America.gov 玩 Minecraft,它写出政府版「街区诗歌」 — bleudog12 · 2026-10-01
- AI 原生政府长什么样:一段谈公民与 .gov 聊天机器人的科幻 — KadriJibraan · 2026-10-01