Anthropic 称蒸馏可放大危险能力,但未给出量化评估

rohanpaul_ai · x · 2026-09-11

Anthropic 最新「AI 滥用」报告提出两个值得警惕的论断:

作者 rohanpaulai 同时指出:报告对这两点关键声明均未提供量化的评估数据,结论目前缺乏实证支撑。

所属事件:Anthropic 报告警示蒸馏放大 AI 危险能力且护栏难迁移(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →