Qwen3.8-Flash杀价:输出2.7元一口价,缓存命中全球最低
AlchainHust · x · 2026-08-27
阿里发布 Qwen3.8-Flash 并同步开源下一代架构权重版 Qwen3.8-Flash-Next。API 定价为每百万 token 输入 0.8 元、输出 2.7 元、缓存命中 0.1 元,全程一口价,无峰谷阶梯——对比 DeepSeek-V4-Flash 空闲 4.5 元/高峰 9 元,Claude Opus 4.6 输入一亿 token 要 500 美元而它只要 80 元。
性能方面官方给出对比表,对照组包括 Qwen3.8-27B、Qwen3.7-Plus、DeepSeek-V4-Flash 和 Claude Opus 4.6。作者还提到 V2EX 上有公司因大模型高峰期 token 翻倍而改倒班考勤省成本的趣闻。
所属事件:阿里发布 Qwen3.8-Flash 多模态 MoE 模型,性价比引热议(26 条相关)→
「模型」频道最新
- Gemini 异常泄露内部思维:回复出现 "sff" — Regular_Preference64 · 2026-08-28
- GLM-5.2 引入监控机制,有效对抗 RL 奖励黑客攻击 — burny_tech · 2026-08-28
- 实测 Anthropic Luna Max:额度宽松速度极快 — timpera · 2026-08-28
- 用户吐槽 Grokbot 表现糟糕,任务遗漏严重 — krishnan · 2026-08-28
- Prime Intellect 发布 18 个前沿模型的自主 AI 研究能力评估报告 — mariofilhoml · 2026-08-28
- 模型优化不应只追求思考时的 token 数量 — abacaj · 2026-08-28