UkisAI 发布 Swift 高效推理模型家族:思考 token 减少 63.4%,速度提升 1.8 倍
Secure_Recording_472 · reddit · 2026-09-25
小型团队 UkisAI 推出基于 Qwen 的 Swift 高效推理 LLM 家族,通过惩罚病态过度思考的 token 并用 GSPO 强化学习和 on-policy distillation(OPD)恢复精度。前作 Swift Qwen 3.8 27B 13 天下载超 35 万次。
本次发布:
- Swift1.5 27B:思考 token 减少 58.5%,平均分数高出基线 0.35%,在 Terminal Bench 2.1 上因不陷入“过度思考错误循环”而优于基线
- Swift Flash Next:思考 token 减少 63.4%,提速 1.8 倍,xhigh 下分数仅 -0.2%
- Swift Bonsai 2(实验性):token 减少 39.8%,分数 +0.19%
基准测试跑 5 次取平均,覆盖 GPQA、AIME26、LiveCodeBench、ERQA、Terminal Bench 2.1。提供 GGUF/NVFP4/MLX/W4A16 量化、Research API 和 HF Spaces;9B 版本即将发布。作者还提到 Terminal Bench 分数偏低是因 Swift 不放弃任务而继续执行,token 用量对比后仍在 -38.7% 左右。
「模型」频道最新
- Relace 成 OpenRouter 最便宜 DeepSeek v4.1 Flash 供应商 — ilyasu · 2026-09-25
- 低成本模型 Jev 展现出一年前顶级模型水平的全球地理理解 — zetalyrae · 2026-09-25
- Claude Opus 5.5 以 88.4% 登顶 SimpleBench — Profanion · 2026-09-25
- Anthropic 恢复对安全拦截请求收费:99.7% 用户不受影响 — ClaudeDevs · 2026-09-25
- 开发者断言:真正拖住 Claude 模型的是 Claude Code 本身 — tokenbender · 2026-09-25
- 博主称 Opus 5.5 惊艳表现暗示 xAI 的 Astra 体量更小 — scaling01 · 2026-09-25