Qwen 3.8 口碑分化
davidtsong · x · 2026-07-21
X 上对 Qwen 3.8 的反馈明显分化。 原帖认为它没有达到“Fable level”的宣传预期。配图是 BenchmarkList 的“Twitter signals”页面,显示该站通过 Twitter API 抓取帖子,汇总 Qwen 3.8 Max Preview 的社交口碑,并按主题统计情绪分布。图里能看到负面、混合、中性、正面讨论并存。 这些讨论主要集中在通用能力、编码、基准测试、产品可用性、Agent 工具、前端设计、可靠性、成本/价值等方面,很多用户提到它的表现不够稳定、输出偏保守,和宣传存在落差。
所属事件:Qwen3.8-Max-Preview 发布实测:编程与工作流亮眼,口碑两极分化(11 条相关)→
「模型」频道最新
- 用户称 K3 在最高级 coding 计划上更快,几乎没遇到限流 — xeophon · 2026-07-21
- 蒸馏梗被玩成“偷窃”笑点,直戳模型复用现实 — pmddomingos · 2026-07-21
- Grok 在 Twitter/X 检索上的表现似乎退步了 — ivan_bezdomny · 2026-07-21
- 用户称 SuperGrok 在简单检索任务上明显退步 — ivan_bezdomny · 2026-07-21
- 中国 LLM 厂商 API 价格战持续加剧 — sen_o · 2026-07-21
- 一个提示词似乎让 Fable 的推理过程直接泄露 — teortaxesTex · 2026-07-21