LatchBio 评测发现 Grok 拒答多来自模型自身,竞品靠外层拦截

kenbwork · x · 2026-09-03

LatchBio 研究员 Arjun 对 Grok 4.6 的生物安全监控与对抗性生物任务做了评测,并拆解了各家模型的拒答机制差异。

这一发现说明「模型拒绝」不等于「模型保守」,拒答行为的架构归属(模型内生 vs 外挂护栏)在不同厂商间差异显著。

所属事件:Grok 4.6 通过 LatchBio 生物安全评测(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →