Qwen3.8-Flash 上线:百万上下文,输入每百万仅需 0.15 美元
Alibaba_Qwen · x · 2026-08-27
Qwen3.8-Flash 现已在 QwenCloud 上线。该模型支持原生长达 26.2 万 token 的上下文,并可扩展至 100 万 token,适合处理长文档和代码库。定价方面,输入价格低至每百万 token 0.15 美元,输出 0.47 美元,缓存命中仅需 0.016 美元。该模型兼容 OpenAI 和 Anthropic API 协议,支持函数调用、结构化输出、Web 搜索和微调等功能。
所属事件:阿里发布 Qwen3.8-Flash 多模态 MoE 模型,性价比引热议(26 条相关)→
「模型」频道最新
- Gemini 异常泄露内部思维:回复出现 "sff" — Regular_Preference64 · 2026-08-28
- GLM-5.2 引入监控机制,有效对抗 RL 奖励黑客攻击 — burny_tech · 2026-08-28
- 实测 Anthropic Luna Max:额度宽松速度极快 — timpera · 2026-08-28
- 用户吐槽 Grokbot 表现糟糕,任务遗漏严重 — krishnan · 2026-08-28
- Prime Intellect 发布 18 个前沿模型的自主 AI 研究能力评估报告 — mariofilhoml · 2026-08-28
- 模型优化不应只追求思考时的 token 数量 — abacaj · 2026-08-28