三模型盲评 880 万词访谈,LeCun 洞察力居首

Tony Wu 发布 Verbatim Index:用 Fable、Astra 和 Gemini 三个前沿模型作为独立评委,基于 653 份播客、访谈与主题演讲的逐字稿(约 880 万词),对 50 位科技领袖的思维质量进行盲评排名,评分按洞察力(占 45%)等维度加权,且只基于逐字记录。结果显示 LeCun 的洞察力登顶,Benioff 垫底,评分代码已全部开源。

2026-10-01 ~ 2026-10-01 · 3 条相关

另有 1 条近重复转述:tonygwu