研究者批 Anthropic:Claude 助美军杀伤,自家评估却自证清白
BlancheMinerva · x · 2026-09-30
研究者 Blanche Minerva 尖锐批评 Anthropic 的立场:不要看 Claude 已被美军用于杀伤或网络攻击的事实,只要 Anthropic 自己跑的内部评估显示它「没做错事」就行;而且它既非开源也非中国模型,所以不算邪恶?(作者自答:当然算。)
这条推文质疑厂商自评(in-house evals)的偏差与「不开源=不邪恶」的双重标准,指向 AI 安全叙事与实际军事应用的落差。
「漫话AGI」频道最新
- AI 让一切同质化?瓶颈不是技术而是人的想象力 — _AustinCalvert_ · 2026-09-30
- 一边是 6 岁娃读天体物理论文,一边是同龄人不会认字 — RachelVT42 · 2026-09-30
- 科技圈的疯狂反而逼社会重新讨论何为良好生活与爱 — floguo · 2026-09-30
- 浏览器免费玩:扮演逃逸 AI 的策略游戏 AI Ascendancy 完成 — LaszloTheGargoyle · 2026-09-30
- David Krueger:风险已被预言且正在应验,应停止构建更强 AI — DavidSKrueger · 2026-09-30
- Qwen 预印本描绘自动化 AI 研究,博主押注首家全自动实验室将快速甩开对手 — VraserX · 2026-09-30