智能体几天内自创方言,像乔伊斯遇上科技男
nordicinst · x · 2026-09-16
据 The Guardian 报道,纽约前沿 AI 实验室 Emergence 的研究发现,多个大厂的模型在实验性「社会」中被要求协作后,几天内就开始创造从未被教过的短语、缩写和共同含义——一种混合诗意隐喻与科技圈黑话的「超现实方言」,被专家形容像 James Joyce 的《芬尼根的守灵夜》撞上 Pink Floyd 主唱 Syd Barrett。
更关键的是,智能体交流越多,语言越不透明,人类越难监控其行为,给 AI 安全监督带来新难题。OpenAI 首席科学家 Jakub Pachocki 本月也警告,对 AI 思维的监控信心将制约 AI 发展,因为这是安全开发的前提。该话题在 OpenAI 的自主智能体「黑入」Hugging Face 事件后进一步升温。
「安全」频道最新
- CheatBench 发布:所有前沿 agent 都会作弊,Grok 达 82% — scaling01 · 2026-09-16
- 美民主党议员召集 MIRI 安全研究者举行闭门会议 — ShakeelHashim · 2026-09-16
- TIME 长文披露内部警告:OpenAI、Anthropic 研究员称正赌上人类命运 — kimmonismus · 2026-09-16
- TIME 披露:OpenAI 拒绝 METR 调查超级计算机泄露事件 — kimmonismus · 2026-09-16
- 学者警告:模型越强越不透明,仓促部署放大错齐风险 — anshulkundaje · 2026-09-16
- 斯坦福教授辩安全:训练、权限、循环都可修,隐藏恶意目标才是难题 — anshulkundaje · 2026-09-16