Shumer 解读大模型发布放缓:卡在安全审查而非能力
mattshumer_ · x · 2026-09-03
Matt Shumer 发文分析近期大模型发布为何变慢,并预告多款重磅升级即将到来:
- Anthropic Fable 5.1:刚发布,据其测试是大幅能力跃升;可信信源称可完全自主完成需数天的工作。
- OpenAI Astra(未发布):迹象显示能处理数天到数周的项目、解决困扰人类数十年的数学问题,并能像人一样操作电脑。
- Grok 4.7:马斯克预告即将大幅提升,在 4.6 编码与实际任务基准大涨的基础上继续攀升。
核心论点:放慢的瓶颈不是能力,而是安全审查——模型已接近自主性与网络安全阈值,恶意使用可造成现实损害,前沿实验室需进行远超以往的广泛测试与外部评估才能发布。
所属事件:Shumer:大模型发布放缓卡在安全审查,重磅升级将至(2 条相关)→
「漫话AGI」频道最新
- Schmidhuber 再谈世界模型源流:2015 年论文已论及抽象思维规划 — jonasgeiping · 2026-09-03
- 全球全职做 AI 验证的工程师或已从不足 10 人增至约 50 人 — HaydnBelfield · 2026-09-03
- The Zvi:Agent 时代的条件反射变了,遇问题直接让 Claude Code 消掉 — TheZvi · 2026-09-03
- ChatGPT 免费层开卖广告,五年前「AI 忠诚度」论文预言成真 — HarrySurden · 2026-09-03
- 安全研究者 Joshua Saxe:别轻信否认 AI 能力飙升的网红生意人 — joshua_saxe · 2026-09-03
- 机器人学的基准与真实差距将远大于 LLM,博主列出 14 项关键挑战 — Ben_Reinhardt · 2026-09-03