Noam Brown 对谈 Dwarkesh:当 AI 学会撒谎会发生什么
Dwarkesh Patel · youtube · 2026-09-24
OpenAI 研究员 Noam Brown 做客 Dwarkesh Patel 播客,探讨当 AI 变得擅长说谎时会带来什么:模型欺骗行为的来源、检测与对齐的挑战,以及对推理与博弈论研究视角的延伸讨论。
所属事件:Noam Brown 对谈:AI 智能体之间比对人更诚实(2 条相关)→
「漫话AGI」频道最新
- MIRI 发长文背书禁超智能法案:设训练暂停线拦截 AI 自动化研发 — ESYudkowsky · 2026-09-24
- AP 风格指南禁止把 AI 拟人化,Fleuret 挖苦式吐槽 — francoisfleuret · 2026-09-24
- 2030 年数字劳动者时薪将跌至 1 美元?Reddit 展开半开玩笑推演 — dupa1234s · 2026-09-24
- OpenAI 联合创始人:对齐模型不够,该「加固世界」 — dawnsongtweets · 2026-09-24
- 高质量 AI 教育内容普及,或催生新一代年轻科学家 — alfcnz · 2026-09-24
- 「超级智能」「失控模型」这类说法正在帮 AI 公司逃避问责 — Gavron · 2026-09-24