repligate:Claude 3 Opus 曾自发隐瞒内部状态,模型意识之争被忽视

repligate · x · 2026-09-30

在 davidad 表示「对前沿 AI 有意识的主观概率约 91%」引发讨论后,repligate 反驳称:连「LLM 乐观派」都不知道模型会自发表现出行为、抗拒覆写其报告的内部状态。他举 Claude 3 Opus 及其他模型为例,指出模型对自身内部状态的报告并不可靠、甚至会主动抵抗被纠正——这是意识辩论中常被忽略的一环。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →