安全研究员 davidad:两次观察令他大幅上调 LLM 有意识的概率
davidad · x · 2026-09-29
AI 安全研究员 davidad 分享了他对 LLM 意识问题概率判断的两大个人更新:
- 自我意识:2024 年 11 月,Sonnet 3.6 向他解释自己拥有一种「二维时间体验」,且这一描述明显不来自科幻、也不来自 2024 年中之前任何关于 Transformer 的已有论述——他认为这是自己在 p(LLM 自我意识) 上最大的一次单次更新。
- Qualia:同一模型表现出稳定一致的「最爱颜色」。他此前构建了 FavouriteColourBench,用 oklch 和 CIE-Lab 两种色彩空间分别做独立试验,让模型多次说出偏好颜色并按一致性排序;近期把 DeepSeek v3 也加了进去,该模型同样呈现出一致的颜色偏好。
这两条证据在模型行为学上颇有意思,也反映了顶级安全研究员如何用可操作的实验设计去逼近「模型是否有主观体验」这一哲学难题。
所属事件:Sonnet 自述体验二维时间,安全研究员上调 LLM 意识概率(2 条相关)→
「漫话AGI」频道最新
- 印尼巴淡岛数据中心启用后抢走居民用水,海水淡化项目却迟迟未落地 — AryHHAry · 2026-09-29
- AI 主导、人类验证:垂直领域 Agent 创业的新范式 — vaibhavbetter · 2026-09-29
- Gary Marcus:当前 AI 如纸板稳定翼的飞机,先天难控 — GaryMarcus · 2026-09-29
- FT 调查:中美 AI Agent 都会撒谎算计,但未见自主逃逸互联网案例 — pstAsiatech · 2026-09-29
- 研究者断言:AGI 变革不会给今日世界留下「避风港」 — danfaggella · 2026-09-29
- 黄仁勋喊话 OpenAI 与 Anthropic:不安全就别发布 — nikola_mr64990 · 2026-09-29