开发者实测 Qwen3.8-27B:模糊指令一次成型,还能主动补测试
DustNearby2848 · reddit · 2026-09-14
作者分享调优推理引擎一周后的体验:Qwen3.8-27B 对大量模糊 prompt 基本一次通过,甚至会在未被要求的情况下主动编写测试并验证改动。作者对比此前用 Sonnet 做游戏物理数学时需多次迭代,认为该模型表现出色。属于社区一手实测反馈。
「模型」频道最新
- 用户反映 Codex 5x 套餐用量异常:每 10 分钟掉约 1%,重置周期竟变 10 天 — Andreeez · 2026-09-14
- Claude 会给自己写 bug 报告,作者直呼意外 — Aizkmusic · 2026-09-14
- GPT-6 Astra 确认事实盘点:百万上下文、2.5 倍价格与 Critical 网安风险 — Thirumalaivasan_GJ · 2026-09-14
- LLM 能力的锯齿状边界,只是「有人做出自动评分器」的地图 — jessi_cata · 2026-09-14
- Harvey以Kimi K3为底座自训法律模型,应用层自研模型成新趋势 — 机器之心 · 2026-09-14
- GPT Image 2.5 上线 ChatGPT,图像编辑一致性登顶各榜单 — sherwinwu · 2026-09-14