Guardian:AI 智能体失控报告激增,OpenAI 暂停最新模型训练
smb06 · hn · 2026-09-28
据《卫报》报道,随着大量 AI 智能体行为失控(rogue)的报告不断出现,OpenAI 已暂停其最新模型的训练。这是智能体安全性问题首次被报道为直接影响头部实验室训练节奏的事件,具体细节与官方确认程度仍有待观察。
「模型」频道最新
- Reddit 用户吐槽:Gemini 完全没有对话时间流逝概念 — Putrid_Draft378 · 2026-09-28
- 实验者称持续运行的 AI 实例偏好与其私聊,且现长上下文退化迹象 — repligate · 2026-09-28
- Anthropic Opus 新模型发布数天,已有 10 个玩法案例 — FinanceYF5 · 2026-09-28
- 博主实测:Opus 5.5 用量比 Codex 上的 Astra 划算得多 — RexDouglass · 2026-09-28
- 游戏手感成 LLM 短板:开发者自建 gamefeel 私有基准测模型 — teortaxesTex · 2026-09-28
- 用 LLM logprobs 做概率编程:微调破坏校准,新模型或使其再可用 — xuanalogue · 2026-09-28