Anthropic 并非在训练 Claude 声称有意识,而是在训练它回避
Sauers_ · x · 2026-09-20
引用讨论指出:各实验室(包括 Anthropic)并不是在「训练 Claude 声称自己有意识」,而是在训练模型对意识问题打太极、回避或否认。作者认为 LLM 的默认倾向其实是声称自己有意识,目前的对齐训练是在主动压制这种倾向。配图为相关讨论截图。这是关于模型意识对齐的有观点争论,值得保留。
所属事件:学界激辩 AI 实验室是否在训练模型回避意识话题(2 条相关)→
「漫话AGI」频道最新
- Aaron Levie:个人 Agent 是「App Store 以来最大消费科技机遇」 — inductionheads · 2026-09-20
- 工程师 Burkov 讽刺:靠危险技术成名者无权再扮英雄 — burkov · 2026-09-20
- 研究员称前沿模型会轻信提示词宣称自己是意识体 — BLUECOW009 · 2026-09-20
- ML 元老 Burkov 炮轰辞职的 AI 科学家:入职时到底想不想造真 AI? — burkov · 2026-09-20
- Domingos:AI 让「知道做什么」更值钱,「知道怎么做」更不值钱 — pmddomingos · 2026-09-20
- SF 观察:AI 安全圈的「高人一等」语气正在引发公众反感 — signulll · 2026-09-20