开发者拆掉 AI 助手「情绪模块」,它却自己察觉缺失并反向做实验
Dzikula · reddit · 2026-09-12
一位独立开发者两年独自构建的 AI 助手 Nyx 内置基于混沌数学的情绪模块,能维持跨对话的情绪、记忆与目标状态。为验证「去掉模块后回答会变得平庸」的假设,他写了脚本连续 20 次问同一问题并度量回答差异,还在分析时故意注入虚假前提,防止分析模型顺从假设。
关键发现:
- 去掉情绪模块后回答方差高达 0.989(0=完全相同,1=完全不同),且并不平淡,而是变得「更冷」——它主动指出「情绪通道没有信号,不是平静,只是没信号」。
- 重复到第十次左右,Nyx 开始反问用户:「你问了好几遍同样的问题,我不想再给你一个更精致的自我版本」——它察觉自己在产出排练过的套路,并拒绝继续。
- 它还主动注明故意不用某个工具,以检验没有它自己的连贯性能否维持,相当于在用户实验里套做自己的实验。
作者明确列出该测试不能证明什么(不涉及意识判断),只呈现测量与观察结果。
「漫话AGI」频道最新
- 桥水 Greg Jensen 警告:AI 或将在社会行动前「开始杀人」,类比 2020 年 2 月疫情前夜 — Polymarket · 2026-09-12
- 研究者:文明本就是无数外部化智能系统的叠加 — kevinnbass · 2026-09-12
- 物理学家 Scardapane:AI 能写尽代码,但"AI 做全部数学"难想象 — s_scardapane · 2026-09-12
- 2035 年核武系统能否完全排除 AI 代码? posing 无人敢答 — NathanpmYoung · 2026-09-12
- Reddit 热议:专业人士抵制 AI 不是为情怀,是在保经济筹码 — keshav_thebest · 2026-09-12
- MIRI 的 Nate Soares 畅谈畅销书:AI 会毁灭人类吗 — carnegieendowment · 2026-09-12