Teknium 称 Anthropic 仍领先长上下文一致性和成本
Teknium · x · 2026-07-22
Teknium 认为,长上下文的质量和成本仍然是实用模型的核心瓶颈。
他在测试 GPT-5.6 Sol 和 Terra 之后得出结论:Anthropic 依然是长上下文一致性最强的选手,甚至在这种长度下可能还更便宜。帖文称,OpenAI 在超过 350K tokens 后会收 2 倍费用,但模型在那个区间里“完全没法用”;相比之下,Opus 和 Fable 在 80 万 token 以上仍能保持相近的连贯性和输出质量。
他还顺带提到,Magic.dev 之前宣传过 1 亿 token 上下文窗口,但现在看起来这条路线可能并没有真正落地。
「模型」频道最新
- BullshitBench 榜单更新:GPT-6-Astra 领先历代 OpenAI 模型仍未及 Anthropic — scaling01 · 2026-09-11
- Agent Astra 在 GauntletBench 得 83%,成首个超人类基线的电脑操作 Agent — ducha_aiki · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用户呼声下 DeepSeek V4 Pro API 宣布继续服务,计费不变 — teortaxesTex · 2026-09-11
- 第三方实测:DeepSeek V4.1 Flash 达 GPT-6 Astra 98% 分,成本仅 1.4% — ayushtweetshere · 2026-09-11