转帖称 Anthropic Claude Opus 5 系统提示词遭 20 万字泄露
Scobleizer · x · 2026-07-25
转发帖称 Anthropic 的 Claude Opus 5 系统提示词被泄露,且长度高达约 20 万字符。原帖进一步把这套护栏描述成“过度保守”,认为它会把基础科学误判成生物武器研究、干扰合法 AI 工作;配图则指向一个整理多家模型泄露系统提示词的 GitHub 仓库。
由于这是一条转述式爆料,事实强度需要谨慎看待,但它的可读性在于两个点:一是“系统提示词泄露”本身,二是围绕安全分类器是否过度拦截、前沿模型该如何在安全与能力之间取舍的争议。
所属事件:Anthropic Claude Opus 5 系统提示词疑遭泄露(2 条相关)→
「安全」频道最新
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- a16z 播客:两三人小团队为何在政策讨论中集体失声 — a16z Podcast · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11
- 医生晒购试剂需背景审查:制造致命病毒哪有那么容易 — Ghost_Pilot_MD · 2026-09-11