GPT-6 强化 prompt caching:agent 更快更省,Context 跨推理档位可复用
OpenAIDevs · x · 2026-09-23
OpenAI 介绍 GPT-6 在 prompt caching 上的改进:agent 在后台做更少的冗余处理,更多上下文在推理力度和工具可用性变化时仍可复用,响应更快更便宜。
同一线程中还给出 AutomationBench(衡量模型能否完成跨应用的真实业务工作流)数据:GPT-6 Sol (xhigh) 以单任务成本低 88% 的成绩领先 Fable 5.1 (max with Opus 5 fallback)。
所属事件:OpenAI 发布 GPT-6 Sol 与 Luna,价格砍半(48 条相关)→
「Infra」频道最新
- vLLM ROCm 团队长期无卡可用,SemiAnalysis 游说后终获 MI355X 集群 — AccBalanced · 2026-09-23
- NCCL 2.31.2 发布:GPU 驱动 CFT 与 0-SM 集合通信,瞄准 Blackwell 级训练 — SkyLi0n · 2026-09-23
- NCCL 2.31.2 发布:GPU 驱动细粒度通信与 0-SM 集合通信等改进 — SkyLi0n · 2026-09-23
- vLLM ROCm 核心维护团队直到近期才拿到持久 MI355X 集群 — AccBalanced · 2026-09-23
- 南非民权组织抗议美国科技公司数据中心扩张,要求暂停建设 — ChinasaTOkolo · 2026-09-23
- Delip Rao 从每月 200 美元降至 50 美元订阅,转向更多使用本地模型 — deliprao · 2026-09-23