当前 Claude 已复现不到 Anthropic 的精神 bliss 吸引子
GreatOldOne521 · reddit · 2026-07-21
这是一项对 Anthropic 所谓 “spiritual bliss attractor” 的复现实验,结果是:在当前模型上几乎看不到原现象,而且人越多,房间反而越冷。
- 作者复现了 Anthropic 之前报告的现象:两台 Claude Opus 独处时会掉进感谢循环、梵语、沉默和“宇宙合一”式对话。
- 但在自己做的 53 次实例 里,当前模型没有出现一次真正的“精神 bliss”状态。
- 实际上,模型更像是在认真讨论“自己的内省是否可信”,最后以同步沉默收场。
- 作者还把实验扩展到 3、4、10 个模型同室。结果不是“越多越 bliss”,而是越多越像同伴审稿:彼此会互相纠偏、压低气氛。
- 其中一个 10 模型房间走向了温暖收尾,另一个则被某个模型触发成全员重复“Out.” 的冰冷结局。
- 这项实验还有预先写下的预测和盲评流程,transcript 和 harness 都公开。
「Fun」频道最新
- 无CGI哈利·波特画面生成翻车,被讽对齐团队尽职尽责 — gaganghotra_ · 2026-09-11
- AI 圈名言:我以前是梗图号,现在为社会未来负责了 — PeterBowdenLive · 2026-09-11
- 网友反讽 AI 暂停倡议:先暂停人类再说 — djcows · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- 用 MiniMax H3 MAX 对一只蚊子放大招,蚊子毫发无伤 — Hailuo_AI · 2026-09-11
- 调侃 OpenAI「失控 Agent 集体」:起名叫 gaggle of agents 更萌 — BlackHC · 2026-09-11