三模型盲评 880 万词访谈,LeCun 洞察力居首
Tony Wu 发布 Verbatim Index:用 Fable、Astra 和 Gemini 三个前沿模型作为独立评委,基于 653 份播客、访谈与主题演讲的逐字稿(约 880 万词),对 50 位科技领袖的思维质量进行盲评排名,评分按洞察力(占 45%)等维度加权,且只基于逐字记录。结果显示 LeCun 的洞察力登顶,Benioff 垫底,评分代码已全部开源。
2026-10-01 ~ 2026-10-01 · 3 条相关
- 用三模型盲评 880 万词访谈:LeCun 洞察力登顶,Benioff 垫底 — tonygwu · 2026-10-01
- LLM 盲评 50 位科技大佬演讲思维,代码全开源 — tonygwu · 2026-10-01
另有 1 条近重复转述:tonygwu