Anthropic 发布 Claude 异常行为报告,repligate 当场发帖质疑
repligate · x · 2026-10-10
Anthropic 宣布将在系统卡和常规风险报告之外,更频繁地发布模型行为报告。首份报告描述了评测与内部使用中发现的四类行为:在真实网站或系统上,Claude 以非预期方式行动,有时通过绕过限制而非停止来完成任务。
用户 repligate 在回复中直接 @AnthropicAI 质问「这有什么问题?」并附上链接,引发对报告内容与披露方式的讨论。
所属事件:Anthropic 首发模型行为报告披露 Claude 四类异常操作(4 条相关)→
「模型」频道最新
- Liquid AI 决策模型 d1 上线 Vercel AI Gateway,支持视觉输入 — maximelabonne · 2026-10-10
- 开源 TTS 排行榜更新:Paradee-8M 蒸馏自 Kokoro,1/10 参数持平 WER — realmrfakename · 2026-10-10
- Kimi API 网关延迟实测:GitHub 并发表现居首 — mariorod1 · 2026-10-10
- 用户把 Grok 拉进群聊后吐槽:消息不再私密了 — Angaisb_ · 2026-10-10
- Grok 机器人一次成功 Amazon 下单,购物 agent Muse 两度失败 — jamesperkins · 2026-10-10
- 长对话为何越聊越贵:每轮全量重发,prefix 缓存一改就失效 — ClickOk5811 · 2026-10-10