Claude Opus 5.5 与 GPT-6 相隔 101 分钟发布,双双降价开打价格战
thursdai_pod · x · 2026-09-28
ThursdAI 播客本期邀请 JevBench 作者 Florian S. 讲解基准建设,并复盘一周大事件:
- 「给前沿减速」承诺一周即破:9 月 12 日 Dario 发文倡议 pace the frontier,Sam、Elon、Demis 签署;9 月 22 日 Anthropic 与 OpenAI 相隔仅 101 分钟先后发布降价新模型。
- Claude Opus 5.5:比 Opus 5 便宜 40%,缓存读取降至 $0.20/1M(从 $0.50),输入 $4、输出 $20——对 agentic coding 场景缓存读取占大头,实际成本降幅显著。
- GPT-6 Sol:定价为 GPT-5.6 的一半,Luna 更再便宜 40 倍。
- JevBench:从零到收录 70+ 模型仅用一周,且已有黑客尝试攻击其测试集,作者在节目中解释了防作弊措施。
- 其他动态:Meta 将 Muse 置于产品核心、Grok 上车 Tesla、开源社区一周内克隆了 Jev。
播客还给出选型建议:按 token 单价 GPT-6 Sol 便宜,但 Opus 5.5 缓存读取仅 20¢,长上下文 agent 场景建议按自己工作负载实测。
所属事件:Opus 5.5 与 GPT-6 相隔 101 分钟发布并双双降价(2 条相关)→
「模型」频道最新
- 开发者猜测 Sol 和 Luna 或为失败训练 run,准备重跑 evals — JoshPurtell · 2026-09-28
- Claude 总能识破"历史的反讽",见多识广让人难再惊讶 — doodlestein · 2026-09-28
- 研究发现 LLM 与人类一样凭长相判断可信度 — luisdans · 2026-09-28
- Anthropic 的 Muse 模型直接「刷爆」验证码引热议 — csuwildcat · 2026-09-28
- OpenAI 修复图像理解 bug,GPT-6 Sol/Luna 视觉能力恢复 — OpenAIDevs · 2026-09-28
- 数据、算力、DeepMind 全都有,Gemini 为何就是打不开局面? — No-Bit5316 · 2026-09-28