84ms 的 Laya 连输三局,本地模型跑得快不等于聪明
eter_inquirer · x · 2026-09-22
tdinhme 在 MacBook 上用国际象棋和俄罗斯方块做本地模型基准:Laya-mlx 推理速度极快(约 84ms),但表现明显更笨,与 Jev 对局三战全败。eterinquirer 复现了同样的观察——Laya 快但总是输棋。结论:本地小模型的延迟优势可能以能力大幅下降为代价,游戏对局可作直观的能力检验方式。
「模型」频道最新
- 曝 OpenAI 训练 24 天的新模型已解决百余个数学开放难题 — IgorCarron · 2026-09-22
- Paradigm 发布 Limite 1B,专攻高频数学推理的 1B 小模型 — tensorqt · 2026-09-22
- 推主推测 Grok Pro 线为 Flash 线延伸,mxfp4 QAT 服务 RL rollout — stochasticchasm · 2026-09-22
- 从 Adam 转向 Muon 中期训练?业界热议预训练优化器切换与 mxfp4 QAT — stochasticchasm · 2026-09-22
- 扩散 LM 快 5-10 倍却没火,Jev 赶上 agent 变强但慢的时机 — eliza_luth · 2026-09-22
- GPT-6 调推理强度不再失效提示缓存,Codex 支持中途自适应推理 — daniel_mac8 · 2026-09-22