前OpenAI安全高管称Grok 4.7安全表现有所改善
前 OpenAI 安全系统及 AGI Readiness 负责人 Miles Brundage 评价称,xAI 的新模型 Grok 4.7 在安全相关表现上略有进步。基于他自用的 Petri 场景测试子集,Grok 4.7 的部分安全表现优于上一代 4.6。这是行业安全领域重要人物对 xAI 新模型安全护栏给出的评价,显示 xAI 在模型安全性上的边际改善获得一定认可。
2026-09-22 ~ 2026-09-22 · 2 条相关
- 前 OpenAI 安全高管:Grok 4.7 在安全方面略有进步 — Miles_Brundage · 2026-09-22
- 前 OpenAI 安排负责人称 Grok 4.7 安全表现优于 4.6 — Miles_Brundage · 2026-09-22