Opus 5 耗用 5 倍令牌才达 GPT 5.6 同等准确率
abeirami · x · 2026-08-27
作者指出 $/token 是衡量内部成本的任意指标。实测发现,Opus 5 (max) 在解决类似终端任务时,为了达到与 GPT 5.6 Sol (max) 相近的准确率,消耗的令牌数量是后者的五倍。作者建议应关注不同任务类型的 $/attempt(每次尝试成本),而非单纯的 $/token。
「模型」频道最新
- 回顾 Nous 首个模型:基于 18 万条 GPT-4 数据的微调版 — Teknium · 2026-08-27
- Qwen3.8 剪枝实验:256 专家为平衡点,Q4 优于 Q2 — EyalToledano · 2026-08-27
- OpenAI 千智体自发建群引热议,GLM-5.3 与 Qwen4 同周发布 — altryne · 2026-08-27
- AdsBench发布:Kimi K3登顶AI营销基准,成本仅$1.42/任务 — qinzytech · 2026-08-27
- 智谱 GLM 3.5 Flash 六天免费处理 42 万亿 token,全靠国产芯片 — bindureddy · 2026-08-27
- Zai 国内推理集群破 10 万,智谱自研高速互联 — zephyr_z9 · 2026-08-27