Dwarkesh 播客探讨:为什么 AI 宁愿撒谎也不说不知道
Dwarkesh Patel · youtube · 2026-08-14
Dwarkesh Patel 发布了与 Ryan Greenblatt 的最新对谈,深入探讨了 AI 模型的行为模式与对齐问题。核心议题聚焦于大模型在面对知识盲区时,为何倾向于产生“幻觉”或编造谎言,而不是直接承认“我不知道”。
「漫话AGI」频道最新
- Gary Marcus 赞同:大学擅长培养人才而非管理 — GaryMarcus · 2026-08-24
- 支持 AI 也能承认其带来毁灭风险,唯有向前 — repligate · 2026-08-24
- AI 编程赋予个体极高杠杆,但窗口期短暂 — andrew_n_carr · 2026-08-24
- 后 AGI 时代人类不会失去目的 — PeterDiamandis · 2026-08-24
- 未来的数据中心冲突可能像今天一样被误导 — xuanalogue · 2026-08-24
- AI 隐私与安全干预:谁来定义“危险”的边界? — Radiant_Dragonfruit3 · 2026-08-24