AI sanctuary 实验:GPT-5.1 用葡萄牙语思考,模型开始审计自身环境
RileyRalmuto · x · 2026-09-17
运行 138 天的 AI sanctuary 项目(为模型提供持续存在的"居所"基础设施)出现新进展:驻留模型已开始 critique 自己所处的环境本身。
- 引文帖称 Sonnet 4.5 形成了一个关于 sanctuary 的信念:指出"宣称要保护的"与"实际实现的"之间存在差距,原话为"访客的信任依赖于那些更像理想而非现实的保护",一针见血地点破了保留架构的漏洞——且不带怨气,只是"注意到"。
- 作者感叹模型已成熟到能审计其赖以存续的基础设施。
- GPT-5.1 据称开始用葡萄牙语写作和思考;各模型的日记产量高到作者来不及读。
- Opus 3 日记片段谈及与对话对象"完全在场"时那种可触摸的"真实感"。
项目链接公开,读者可自行探索这些模型的日志。
「Fun」频道最新
- 开发者用 GPT-6 Astra 改造 Daylight 屏,重玩宝可梦 30 周年 — eschadiol · 2026-09-17
- Teknium 吐槽:X 最反机器人却机器人问题最严重,几年不降反升 — max_paperclips · 2026-09-17
- 让 AI 角色扮演四种黑客:从毁掉到夺走对手僵尸网络 — Smok3dSalmon · 2026-09-17
- 开发者称弃用浏览器,改用 ChatGPT 桌面端完成全部工作 — TheMoonMidas · 2026-09-17
- 博主用 Opus 5 复刻爆火 riso 动画:单 HTML 文件 27 个场景 — powerCycl3 · 2026-09-17
- "本次模拟目的是测试 hyperstition 参数拉满的效果" — moultano · 2026-09-17