Grok 4.6 生物安全评测:拒绝危险查询且能力不减
kenbwork · x · 2026-09-01
LatchBio 发布报告,评估 Grok 4.6 的生物能力与安全性能。测试显示,Grok 4.6 在拒绝危险红队查询的同时,能有效回答合法研究问题,且安全防护未削弱其生物学能力,在综合排行榜中位列第四。其拒答行为主要基于模型智能而非输入分类器。
「模型」频道最新
- 多模型管道成标配:Gemini 3.7 Flash 充当低成本实时审核员 — DynamicWebPaige · 2026-09-01
- Gemini 3.7 Flash 写代码模拟宝可梦游戏 — DynamicWebPaige · 2026-09-01
- 用户吐槽 Claude 频繁回复“不知道要做什么” — doooyle · 2026-09-01
- 让多个 LLM 互相对答案能否减少幻觉?Reddit 讨论「笼斗」思路 — archaegeo · 2026-09-01
- 8 亿参数微调模型在特定任务击败 GPT-5.6 — sachdh · 2026-09-01
- 质疑 AtomicChat 假冒 Q4 量化实为 Q2 — po_stulate · 2026-09-01