新 Claude 模型实测:推理能力提升,思考 token 消耗巨大

kimmonismus · x · 2026-08-24

用户测试了疑似 Opus 5.1 的新 Claude 模型,发现在中等难度推理任务上表现优异,且在 3D 强化学习任务中表现良好。观察到一个显著特征是模型消耗了大量的“思考 token”,多次触达最大 token 限制。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →