LLM 盲评 50 位科技大佬演讲思维,代码全开源
tonygwu · x · 2026-10-01
Tony Wu 发布 Verbatim Index:用三个 LLM 评审盲评 50 位知名科技公司领导者在访谈、播客、主题演讲中展现的思维方式并排名,评分只基于逐字 transcript,不考虑公司业绩、市值或声誉。完整排名、方法论和每条评分背后的 transcript 均公开,代码、评分标准与评测框架开源在 GitHub(data 仓库私有)。
另有姊妹产品 Verbatim Predictions:把同一批 transcript 变成可审计的「可证伪预测」索引,每条预测都锚定在带时间戳的原始引文上,可检验这些大佬说过的话是否兑现。
所属事件:三模型盲评 880 万词访谈,LeCun 洞察力居首(3 条相关)→
「Fun」频道最新
- SWE 花七万美元买特斯拉没人眨眼,买 RTX Pro 显卡却被群嘲 — Sentdex · 2026-10-01
- 「用 agents 造东西」听成「用 Asians 造东西」?Dylan 的全球化冷笑话 — dylan522p · 2026-10-01
- Sentdex 疑问:Hugging Face 手握海量开发者资源,为何不做编码 Agent? — Sentdex · 2026-10-01
- 「宝贝别生气,Juliet 是我的 OpenAI 私人助理」梗图刷屏 — tech__unicorn · 2026-10-01
- 自主运营公司平台 Polsia 翻车:引导失败一周仍未恢复 — Fun-Telephone-681 · 2026-10-01
- 《黑客帝国》式「我会功夫」靠阅读可达,作者押注脑机接口做不到 — StewartalsopIII · 2026-10-01