10ms 纯 CPU 玩 Doom:106M 小模型击败 500ms 的 Jev
Playful_Suggestion_3 · reddit · 2026-09-29
作者发布 Go 库 indecis(MIT 协议),微调一个小型文本编码器(约 106M 参数,几十 MB)来回答类型化问题(是/否、多选、量表,带概率),实现在单 CPU 核心上以 10ms 中位延迟玩 Doom。对比:Jev 决策需 70–500ms 且为托管服务,LAYA 为 421M 参数、98ms/决策。在 ViZDoom defendthecenter 场景 20 轮测试中平均 +21.8 分,追平生成训练数据的脚本机器人,内存约 65MB,笔电上 11 分钟即可训完。关键在速度:去掉 SIMD 后单次决策 180ms,每场漏 60 次决策,成绩差十倍。作者思路是用专精小模型换通用模型的速度,下一步想把 Xolo LLM 网关的 llm-classifier 插件改为本地小模型,省掉几百毫秒网络往返。
「模型」频道最新
- 博主横评:GPT 6.1 SOL 强于推理分析,Fable 与 Opus 专精编码 — bindureddy · 2026-09-30
- 用户实测 Opus 5.5:速度快但常无视技术规格自行改写代码 — ssh4net · 2026-09-30
- 前沿模型正吞并专业视觉模型的地盘:CV 能力长文盘点 — ShahabBakht · 2026-09-30
- 18 个月智能-成本前沿巨变:从 GPT-5 mini 17 分到 Opus 5.5 拿下 58 分 — ArtificialAnlys · 2026-09-30
- OpenAI 发布 dots 仅限付费当天,开源版 Open Dots 数小时复刻 — victor_explore · 2026-09-30
- Steve Yegge 持有 22 个 Claude Max 账号,靠周重置活动继续高强度炼丹 — Steve_Yegge · 2026-09-30