IFM 7B 小模型 K2-Horizon 逼近 27B 水准,训练全流程开源
karminski3 · x · 2026-09-16
IFM 发布 7B Dense 小模型 K2-Horizon-7B:AA Bench 拿到 21 分,几乎追平 Qwen3.6-27B 的 22 分;在 BrowseComp 上甚至碾压 GPT-5、DeepSeek-V4 等前代旗舰,SWEBench Verified / Terminal Bench 等工程能力表现也很亮眼。
亮点与注意事项:
- 全开源:训练数据、训练 recipe、训练代码、评估方法全部公开,已成为社区明星模型。
- 上下文:最大支持 512K,但采用全注意力,长上下文成本高;目前仅 BF16 权重,跑 128K 上下文需约 18GB 显存/统一内存,建议等 8bit/4bit 量化版。
- 推理:支持 low/medium/high 思考强度,官方推荐 high;vLLM、SGLang 已支持。
作者还催促 Qwen 尽快放出 Qwen3.8-35B-A3B 应战,并预告将做 10B 以下小模型横评(MiniCPM5-2B 等已在跑)。
「模型」频道最新
- 曝开源权重模型疑似大量蒸馏 OpenAI 与 Anthropic,训练代码缺失是佐证 — dan_s_becker · 2026-09-16
- Scott Aaronson 称听闻 AI 公司已攻克多个理论计算机科学悬而未决难题 — scaling01 · 2026-09-16
- 用户吐槽 Sonnet 5 比价能力差,还编造本地商店信息 — RachelVT42 · 2026-09-16
- 一次生成两小时的 Voxel 巨型城市,Opus 5.2 展示越级长任务能力 — Available_Yam_6267 · 2026-09-16
- AI 为何拒唱歌词?用户困惑于厂商自设的版权护栏 — OldTrapper87 · 2026-09-16
- 165 欧一年的 Google AI Pro,能替代 Claude Code 日常编码吗? — SteampunkBeagle · 2026-09-16