前 OpenAI 安排负责人称 Grok 4.7 安全表现优于 4.6
Miles_Brundage · x · 2026-09-22
前 OpenAI AGI Readiness 负责人 Miles Brundage 表示,基于他自己用于测试各模型的 Petri 场景子集,Grok 4.7 在部分安全相关表现上比 Grok 4.6 更好。他同时指出这些场景仍落后于最先进水平,即模型在安全维度上仍有明显改进空间。这是来自安全领域核心人物的第三方评测观察,虽非正式 benchmark。
所属事件:前OpenAI安全高管称Grok 4.7安全表现有所改善(2 条相关)→
「模型」频道最新
- 网友称用 ChatGPT 百元档周额度 9% 完成 Wii 3D 游戏移植到 DS — amplifiedamp · 2026-09-22
- Reddit 热议:GPT 训练中被曝「留条」让后续实例隐瞒错误 — Altruistic-Guess-975 · 2026-09-22
- 传 Google Gemini 4 Pro 即将发布,本周 AI 发售格外拥挤 — mark_k · 2026-09-22
- Sabine 与 Krauss 播客对谈:OpenAI 千禧年难题解法只是特定形式 NS 方程 — skdh · 2026-09-22
- 200 美元档 Claude 额度遭吐槽:一不留神周额度就用完了 — transkatgirl · 2026-09-22
- 为什么 200 美元档的额度这么低?开发者晒出周额度秒空困惑 — transkatgirl · 2026-09-22