第三方评测:Grok 4.6 生物安全拒答平衡居首

XFreeze · x · 2026-09-02

xAI 发布新博客谈前沿模型的生物安全。独立机构 LatchBio 在 BioSecBench-Refusal 评测中,给 Grok 4.6 打出 62.1% 的综合分:对红队生物攻击任务拒答 59.2%,同时仍能完成 64.8% 的常规生物学工作,是唯一在两项上都超过 50% 的受测模型。评测追踪显示 Grok 并非靠关键词触发拒绝,而是会检查文件、上下文与隐藏意图,识别看似正常的科学任务背后的危险性。

所属事件:第三方评测称 Grok 4.6 生物安全平衡居首(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →