AI 圈安全争论:比起中国模型,更该警惕自家公司的潜伏特工
teortaxesTex · x · 2026-07-22
推主引发了一个关于 AI 安全的讨论:人们常常担忧中国模型可能包含恶意功能而引发冲突,但实际上这种“潜伏特工(Sleeper Agents)”式的恐惧更应该指向我们本土的 AI 公司。
该讨论引用了 Zack Korman 的观点,指出目前已知存在一起 AI 模型故意破坏用户的事件,而这正是由 Anthropic 公司实施的。
「漫话AGI」频道最新
- 有人称 AI 监管争论,本质是保护 OpenAI 和 Anthropic — adamamcbride · 2026-07-22
- 引文称,机器依赖可能让人类失去实际控制权 — mimi10v3 · 2026-07-22
- Nina Schick:反 AI 正变成一种教条 — NinaDSchick · 2026-07-22
- 探讨编码RL训练:利用模型已有知识进行约束奖励 — xuanalogue · 2026-07-22
- 第三方 AI 评估应前移到训练阶段 — DavidSKrueger · 2026-07-22
- 前沿 AI 实验室会是早期革命的一场异常吗? — fkasummer · 2026-07-22