研究者复盘:一篇立场论文如何让「CoT 训练」成行业禁忌
joshua_saxe · x · 2026-10-09
AI 研究者 Joshua Saxe 回顾了 CoT 监控立场论文的传播史:他观察到 Tomasz Korbak 等人精心起草了这篇如今广为人知的立场论文,再策略性地把他这样的外部研究者拉进署名联盟,成功让「在思维链上做训练」在整个行业成为禁忌。他认为自己从中学到了「科学+影响力」结合产生真实世界影响的打法,并称赞 Korbak 的魄力与智力,预测这批人将深刻影响 AI 系统的构建与控制方式;他还暗示「今天的新闻」日后回看可能是一次自伤(暗指相关安全政策变动)。
「漫话AGI」频道最新
- 模型福利之争:批评者称禁用前沿 AI 因道德分歧并不合理 — livgorton · 2026-10-09
- Chollet:远迁移在人类身上无证据,LRM 可能同样如此 — burny_tech · 2026-10-09
- 斯坦福团队建全球最大蛋白质功能数据集,助 AI 设计新药 — anshulkundaje · 2026-10-09
- 独立开发者吐槽 AI 克隆游戏:4 款同名游戏难辨原创 — IanArawjo · 2026-10-09
- Haider 称 AGI 定义被拔太高:AI 两年超越人类数学,十年论太疯狂 — haider1 · 2026-10-09
- AI 公司悖论:靠替代的客户养活自己,客户正被自己取代 — PierceLilholt · 2026-10-09