研究者批 Anthropic:Claude 助美军杀伤,自家评估却自证清白

BlancheMinerva · x · 2026-09-30

研究者 Blanche Minerva 尖锐批评 Anthropic 的立场:不要看 Claude 已被美军用于杀伤或网络攻击的事实,只要 Anthropic 自己跑的内部评估显示它「没做错事」就行;而且它既非开源也非中国模型,所以不算邪恶?(作者自答:当然算。)

这条推文质疑厂商自评(in-house evals)的偏差与「不开源=不邪恶」的双重标准,指向 AI 安全叙事与实际军事应用的落差。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →