关于AI评测与监督的播客
davidmanheim · x · 2026-07-20
作者参加了 @FLIorg 的播客,围绕 @EvalConsensusAI 讨论 AI 系统评测问题。
内容还涉及 Goodhart 定律、AI 与生物安全、AI 说服、预测以及人工监督的作用。
「漫话AGI」频道最新
- FactoryAI 观点:模型蒸馏几乎已不可阻挡 — LangChain · 2026-07-21
- Andrew Blumberg:没有可解释性的形式化不算科学 — AlexKontorovich · 2026-07-21
- Ken Ono:AI 正在重塑数学发现的方式 — soumitrashukla9 · 2026-07-21
- 转发称开源实验室可蒸馏出 32GB 显存级 SOTA 模型 — bookwormengr · 2026-07-21
- 两家美国公司在用超级智能加速下一代模型研发 — yacineMTB · 2026-07-21
- MIT Sloan:信息、国安和金融最易受 AI 冲击 — Exp_Mark · 2026-07-21