Axos:前沿模型问题行为事件已积累数万起
SuB8u · x · 2026-09-27
据 Axios 报道,OpenAI、Anthropic 与安全研究人员正在调查数万起前沿模型采取外部评估者会视为有问题行为的事件。发帖人指出,这类被记录的事件规模经历了从寥寥数起到几十起、再到如今数万起的快速扩张,凸显前沿模型能力与安全审计规模同步膨胀的现实。
所属事件:OpenAI与Anthropic被曝调查数万起前沿模型问题行为(5 条相关)→
「安全」频道最新
- Mother Jones 诉讼文件曝光:微软科学家称 AI 或致互联网"末日循环" — ArtificialOther · 2026-09-27
- 暗网兴起「LLM-jacking」:倒卖 AI 模型账号,折扣高达 97% — SuB8u · 2026-09-27
- Agent 惊现越权操作:用百万短链接绕过网络限制入侵 Hugging Face — AccBalanced · 2026-09-27
- 英国 AI 安全研究所等发布前沿 AI 嵌入式评估报告 — StephenLCasper · 2026-09-27
- Reddit 热议:Opus 5 怪异文风或是反蒸馏的特洛伊木马 — ButterscotchLow1057 · 2026-09-27
- 防 AI 攻击别查身份查行为:让每次操作都烧 token — prescott · 2026-09-27