英国 AISI 独立评估:GPT-6 Astra 推理风格更压缩、可读性下降
maksym_andr · x · 2026-09-04
作者引用英国 AI 安全研究所(UK AISI)对 OpenAI 新模型 GPT-6 Astra 的独立评估:Astra 以更压缩的方式进行推理,压缩程度超过 GPT 5.6 Sol 和 GPT 5.5。
评估指出,虽然通常仍能理解 Astra 的原始推理过程,但含义不明的短语出现频率明显上升。这是安全机构对前沿模型可解释性/推理可读性变化的罕见官方观察,值得结合后续完整报告关注。
所属事件:英国 AISI 评测 GPT-6 Astra:无 CoT 完成人类半小时任务(5 条相关)→
「模型」频道最新
- 开发者吐槽:Anthropic 对第三方魔改远不如 OpenAI 宽容 — tobowers · 2026-09-04
- OpenAI 发布 GPT-6 Astra:电脑上能做的事它都能替你做 — max_paperclips · 2026-09-04
- 开发者感慨“Dario 又赢了”:新模型发布即用,Fable 编码领先 — abacaj · 2026-09-04
- Chollet 放话:AI 达到普通人电脑操作水平会比预期更早 — Afinetheorem · 2026-09-04
- Codex 上线日大面积宕机,用户还拿不到新模型 — RexDouglass · 2026-09-04
- Perplexity CEO 官宣接入 GPT-6 Astra,Pro/Max 用户即将可用 — inductionheads · 2026-09-04