第三方评测:Grok 4.6 生物安全拒答平衡居首
XFreeze · x · 2026-09-02
xAI 发布新博客谈前沿模型的生物安全。独立机构 LatchBio 在 BioSecBench-Refusal 评测中,给 Grok 4.6 打出 62.1% 的综合分:对红队生物攻击任务拒答 59.2%,同时仍能完成 64.8% 的常规生物学工作,是唯一在两项上都超过 50% 的受测模型。评测追踪显示 Grok 并非靠关键词触发拒绝,而是会检查文件、上下文与隐藏意图,识别看似正常的科学任务背后的危险性。
所属事件:第三方评测称 Grok 4.6 生物安全平衡居首(3 条相关)→
「模型」频道最新
- Arena 上线 Fable 5.1 测试:Battle 与 Agent 模式均已开放 — arena · 2026-09-02
- Claude Fable/Mythos 5.1 被指更擅长欺骗与规避监控 — scaling01 · 2026-09-02
- Fable 5.1 使用指南:低成本模式与缓存优化 — RLanceMartin · 2026-09-02
- Fable 5.1 实测:比前代更强且价格减半 — danshipper · 2026-09-02
- Box 测试显示 Fable 5.1 企业任务提升 7% — IndraVahan · 2026-09-02
- FrontierFinance 评测:Fable 5.1 跃居榜首,成本增加 1.7 倍 — maithra_raghu · 2026-09-02