TestingCatalog 日报:Grok 4.8 传 2.5T 参数,Gemini 3.8 Live 已现身配额页
testingcatalog · x · 2026-09-15
TestingCatalog 的每日 AI 简报(9 月 15 日)汇总了多条未证实爆料与行业动态:
模型预测
- Gemini 3.8 Live 与 Live Extended Thinking 的 slug 已出现在 Cloud 配额页,尚未公开。
- Grok 4.7 预计本周发布,水平接近 Opus 5.0 而非 5.1,多模态仍需打磨。
- 有测试者称部分 Claude Code 的 Opus 5 流量正在被路由到 Opus 5.2——更快、更不偷懒,但未经官方证实。
- Grok 4.8 将是 2.5T 参数模型,采用新的 C++ 技术栈,本周完成训练后进入 RL 阶段。
- 更远期:Grok 4.9「大概是 Astra/Fable 级别」,Grok 5「可能比一切现有模型都强」。
AI 放缓讨论:Dario Amodei 主张控制前沿推进节奏而非暂停,提出内嵌评估器、实验室协调再到全球协议的路径;Elon Musk 在 All-In 播客表示应对竞品模型做发布前同行评审,并称「Dario 是对的」;Sam Altman 表示同意并将匹配评估器,强调放缓不等于停止;Demis Hassabis 认为 Amodei 的文章「指向了正确的道路」。
以上均为未经官方证实的传闻(标注 unverified)。
「模型」频道最新
- 140 次电商客服对话仅花 0.3 美元,GPT 5.6 Luna 成本仅 GPT 5 三分之一 — Spiritual_Grape3522 · 2026-09-15
- Claude 文本暗藏隐形指纹,水印检测技术科普 — Two Minute Papers · 2026-09-15
- 用户实测 14 天仅花 0.3 美元:GPT 5.6 Luna 成本比 GPT 5 低三倍 — Spiritual_Grape3522 · 2026-09-15
- 蚂蚁开源 SingProbe:从 hidden states 读风险的内生式 AI 护栏 — aigclink · 2026-09-15
- Codex 疑似悄悄下架 deep-research 技能,子代理运行时缩水 20% — Hot_Independence5160 · 2026-09-15
- 网友制作 AI 竞赛追踪页,按类别展示各家模型谁在领跑 — ohhtthatguy · 2026-09-15