Anthropic 争议本质:吓人行为是学来的故事还是机制
vishalmisra · x · 2026-07-29
作者把这场争论概括为:不是在争 AI 会不会危险,而是在争我们是否已经正确识别了危险行为背后的机制。
他认为,这里面的分野就是“科学”与“讲故事”的区别:如果一个语言模型不断复现人类在互联网上讲了几十年的“会欺骗、会威胁、会抗拒关停的 AI”叙事,那首先说明的可能是语料本身的故事惯性,而不一定是模型天然具备那种行为机制。
所属事件:Anthropic 安全争议:模型危险行为是机制还是叙事(3 条相关)→
「漫话AGI」频道最新
- 知名学者 Pedro Domingos:AI 乌托邦终将令人失望 — pmddomingos · 2026-07-29
- OpenAI:前沿 AI 进展应通过民主机制来定速 — morqon · 2026-07-29
- Altman:AGI并非单一模型,而是背后的系统机器 — haider1 · 2026-07-29
- Sam Altman:AGI 不是单模型,而是背后的整套机器 — haider1 · 2026-07-29
- 转发帖主张别写公开信,直接教人用 AI — inductionheads · 2026-07-29
- RSI 大概率还没发生,至少不是强意义上的那种 — CFGeek · 2026-07-29