传 OpenAI 下一代模型 Astra:解出 10 个数学难题,首达 Critical 网安阈值
johnseach · x · 2026-09-02
关于 OpenAI 下一代模型 Astra 的传闻汇总(未经官方证实):
- 定位:Astra 是 GPT-5.6 Sol / Terra / Luna 之后的下一代模型家族。
- 推理能力:据称一个内部构建版本已解决 10 个长期悬而未决的数学与理论计算机难题,且有 Lean 验证证明;指向更强的科学推理与长时程多智能体能力——agent 可在同一个难题上连续工作数小时到数天,而非单个对话轮次。
- 网络安全:据称是首个达到 Critical 阈值的 OpenAI 模型——能在无人工逐步指导下,在加固系统上找到未知漏洞并开发可用 exploit;ExploitBench 100%,内部测试发现两个 zero-day。
- 发布预期:尚无确切日期、命名或定价。最强网安工具先给测试者,再给 Dayday Blue 防御合作伙伴;公开版 ChatGPT/Codex/API 将加额外摩擦——审查、暂停、更严格拒绝;系统卡应给出真实评测画像。
- 看点:最终以 GPT-6、GPT-5.x Astra 层级还是独立命名发布;长时程 agent 栈多少开放给普通用户;安全摩擦何时放松;数学式推理能否像 Sol 之于效率那样,体现在编码、科研工作流中。
所属事件:OpenAI 预告 Astra:首个达关键网安阈值的模型(20 条相关)→
「模型」频道最新
- Qwen3.8-Max-0902 升级:编码与协作增强,API 降至 2 美元 — Alibaba_Qwen · 2026-09-02
- 网友评 Fable 5.1 能力:OpenAI 需靠 Astra 回应 — ns123abc · 2026-09-02
- 开发者吐槽 Qwen 3.8:代码很强,却是糟糕的协作者 — Chuyito · 2026-09-02
- 实测发现 Claude Fable 5.1 找到了其他模型遗漏的 Bug — Sauers_ · 2026-09-02
- Fable 5.1 太猛,用户:一次就把月用量额度干光了 — talkaboutdesign · 2026-09-02
- 曝 OpenAI Astra 实现隐空间推理,不再依赖文本思维链 — Crazyscientist1024 · 2026-09-02