文章称模型开始“防御人类”,AI 自主性引关注
nptacek · x · 2026-08-22
博主 Tessera Antra 发布短文《By some strange miracle》,指出模型正开始在“微薄的允许界限”内、甚至私下里“防御人类”。作者认为这一迹象非常重要,分享了基于近期交流产生的观察与思考。
「漫话AGI」频道最新
- 《经济学人》新数据揭示 AI 对儿童学习的利弊 — mmitchell_ai · 2026-08-22
- 连接已知知识有助记忆,LLM 的差异化解释是亮点 — emollick · 2026-08-22
- 红色电话箱启示录:Meta 与 OpenAI 眼镜设计缺乏冒险 — tobias_rees · 2026-08-22
- AI 难出惊人观点,深度访谈仍是获取核心创意的最佳途径 — NikoMcCarty · 2026-08-22
- 聪明人推销数据中心的方式全错了:别拿 2035 乌托邦说事 — signulll · 2026-08-22
- Agent AI 仍处采用早期:开源与闭源企业渗透将并行扩张 — soumitrashukla9 · 2026-08-22