Grok 4.6 登顶生物安全基准,拒绝攻击同时保留科研能力
XFreeze · x · 2026-09-02
据 LatchBio 的独立生物安全基准测试,Grok 4.6 击败了 GPT-5.6 Sol 和 Claude Opus 5 等主要前沿模型。其获胜的关键在于极佳的平衡性:
- 能够有效识别并拒绝伪装的生物安全攻击。
- 仍然能够协助合法的双重用途科学研究。
- 保持强大的生物学智能。
测试发现,Grok 的这种平衡主要源于模型自身的智能和推理能力,而非严重依赖外部分类器或系统级拦截。与此同时,Grok 在治疗、变异发现、表观基因组学等多个生物领域仍处于最前沿。
所属事件:Grok 4.6登顶生物安全基准 拒答与科研能力兼得(4 条相关)→
「模型」频道最新
- 专家质疑 OpenAI Astra 评估存数据污染与元游戏风险 — ShakeelHashim · 2026-09-02
- Astra 刷爆 ExploitBench 百分百胜率,达网安临界能力 — infoxiao · 2026-09-02
- Anthropic 用激活探针检测 Claude 网络安全威胁 — nrehiew_ · 2026-09-02
- RWKV-7 G1j 发布:纯 RNN 架构在 agent 与编码任务大幅增强 — jeremyphoward · 2026-09-02
- Fable 5.1 三十分钟一次成型可用的吉他 VST 插件 — CtrlAltDwayne · 2026-09-02
- Fable 5.1 自选目标解开 373 年历史密码 — rickasaurus · 2026-09-02