UkisAI 发布 Swift 高效推理模型家族:思考 token 减少 63.4%,速度提升 1.8 倍

Secure_Recording_472 · reddit · 2026-09-25

小型团队 UkisAI 推出基于 Qwen 的 Swift 高效推理 LLM 家族,通过惩罚病态过度思考的 token 并用 GSPO 强化学习和 on-policy distillation(OPD)恢复精度。前作 Swift Qwen 3.8 27B 13 天下载超 35 万次。

本次发布:

基准测试跑 5 次取平均,覆盖 GPQA、AIME26、LiveCodeBench、ERQA、Terminal Bench 2.1。提供 GGUF/NVFP4/MLX/W4A16 量化、Research API 和 HF Spaces;9B 版本即将发布。作者还提到 Terminal Bench 分数偏低是因 Swift 不放弃任务而继续执行,token 用量对比后仍在 -38.7% 左右。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →