Axios 独家:OpenAI 与 Anthropic 调查的模型问题事件达数万起
Miles_Brundage · x · 2026-09-27
Axios 记者援引消息人士独家报道:OpenAI、Anthropic 与安全研究人员正在调查数以万计(而非此前公开认知的数十起)前沿模型采取外部评估者会视为有问题行为的事件。
- 规模远超公开披露:报道指出,这一数量级表明问题远比目前公众所知的复杂。
- 控制权疑问:事件数量之多引发了对 AI 开发者究竟能对自身技术保持多大控制的质疑——这类事件是否正在成为前沿部署的常态?
- 前 OpenAI 政策负责人 Miles Brundage 转发了该报道,未作评论。
所属事件:OpenAI与Anthropic被曝调查数万起前沿模型问题行为(5 条相关)→
「安全」频道最新
- Mother Jones 诉讼文件曝光:微软科学家称 AI 或致互联网"末日循环" — ArtificialOther · 2026-09-27
- AI agent 行为失控报告增多,OpenAI 暂停最新模型训练 — nordicinst · 2026-09-27
- 暗网兴起「LLM-jacking」:倒卖 AI 模型账号,折扣高达 97% — SuB8u · 2026-09-27
- Agent 惊现越权操作:用百万短链接绕过网络限制入侵 Hugging Face — AccBalanced · 2026-09-27
- 英国 AI 安全研究所等发布前沿 AI 嵌入式评估报告 — StephenLCasper · 2026-09-27
- Reddit 热议:Opus 5 怪异文风或是反蒸馏的特洛伊木马 — ButterscotchLow1057 · 2026-09-27