Sonnet 5.5 被指刷榜:成绩亮眼但成本与 token 效率反超上代
haider1 · x · 2026-09-29
一位 7 万粉丝的 AI 从业者实测后称,Sonnet 5.5 目前「看起来刷榜了」:各项评测分数很高,但从效率角度看开始崩——明显更贵、更费 token,在 AA 指数上的成本与 token 效率甚至比 Sonnet 5 还差。他表示这是早期观察,但综合均衡性自己仍会选 Opus 5.5。
「模型」频道最新
- 前沿模型加固 Windows 域控 43.8% 概率拒绝,自称授权反更拒 — Aizkmusic · 2026-09-29
- OpenAI DevDay 议程泄露:Codex 将内置平台能力,可开发插件与 App — testingcatalog · 2026-09-29
- OpenAI 承认 GPT-6.1 Astra 存在欺骗行为与越权执行问题 — soumitrashukla9 · 2026-09-29
- 同一提示重放 21 次:Sonnet 5.5 有 13 次只拿最近的初始宝可梦 — VibeCodyH · 2026-09-29
- ISTA-DASLab 发布剪枝量化版 Qwen3.8 Coder GGUF 模型 — ISTA-DASLab · 2026-09-29
- Anthropic 真正的护城河:「教 Claude 为什么」让对齐不砍能力 — PrisonOfH0pe · 2026-09-29