前 OpenAI 安排负责人称 Grok 4.7 安全表现优于 4.6

Miles_Brundage · x · 2026-09-22

前 OpenAI AGI Readiness 负责人 Miles Brundage 表示,基于他自己用于测试各模型的 Petri 场景子集,Grok 4.7 在部分安全相关表现上比 Grok 4.6 更好。他同时指出这些场景仍落后于最先进水平,即模型在安全维度上仍有明显改进空间。这是来自安全领域核心人物的第三方评测观察,虽非正式 benchmark。

所属事件:前OpenAI安全高管称Grok 4.7安全表现有所改善(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →