OpenAI新模型Astra因触达Critical能力阈值暂停部分开发
johnseach · x · 2026-08-17
梳理 OpenAI 下一代大模型 Astra 的最新状态(8月17日):
- 8月1日 OpenAI 低调确认其存在:内部版本解决了数学与理论计算机科学领域十个长期悬而未决的问题(包括首个显式 non-sofic 群、推翻 Connes 刚性猜想等),全部附机器可验证的 Lean 证明。
- 8月7日,评估显示 Astra 在 agentic coding 和网络安全上能力强劲,按 Preparedness Framework 无法排除达到 Critical 级别——即能在加固系统中找 zero-day、或在极少人工辅助下从高层目标规划完整攻击,这是首个触及该阈值的模型。OpenAI 随即收紧沙箱、监控与访问控制,并与政府机构及安全组织合作。
- Sam Altman 表示仍打算公开发布(「希望不会太久」),但需要更多时间保证安全。无官方发布日期、定价或 API 细节。
- 目前 X 上「本周发布」均为传闻:员工模糊暗示、内部 dogfooding、大规模 pretrain、多智能体强度与内部 checkpoint 代号等。
结论:Astra 真实且先进,安全暂停属实,本周发布仅是谣言。
「模型」频道最新
- 腾讯 EVIE 模型登顶 ViDoRe 榜单,向量存储降本 32 倍 — jacek2023 · 2026-08-17
- 欧洲企业借「监管外壳」用中国开源模型,引热议 — teortaxesTex · 2026-08-17
- empero-ai 蒸馏版 Qwen3.8-9B 登上 Hugging Face 热榜 — empero-ai · 2026-08-17
- 开发者发现 gpt5.6-sol 工具调用存在缓存问题 — lucasmeijer · 2026-08-17
- 实测对比:Sol 与 GLM-5.3 发现代码高危漏洞,Claude 未检出 — morgymcg · 2026-08-17
- DeepSeek v4 Pro 评测:多数任务接近 Flash 版,架构扩展性引疑 — teortaxesTex · 2026-08-17