Kimi K3 等开源大模型或严重欠训练,数据 scaling 远未见顶
zeeshanp_ · x · 2026-09-23
作者 zeeshanp 从近期前沿模型发布得出结论:像 Kimi K3 这类大型开源模型很可能存在严重欠训练(undertrained)问题。这意味着数据 scaling 仍有很大提升空间,开源模型与前沿闭源模型的差距部分来自训练数据规模不足,而非能力天花板。
「Infra」频道最新
- 工程师求全离线文档问答方案:Ollama+Open WebUI+RAG 组合获荐 — betobagio · 2026-09-23
- 评论者批 Googlebook 硬件无野心:Intel NPU 放弃消费级市场 — julianharris · 2026-09-23
- vLLM 支持 Google DiffusionGemma:块扩散 MoE 吞吐约提升 1.9 倍 — vllm_project · 2026-09-23
- 从业者泼冷水:约三分之二场景 LLM 推理提速并不惊艳,全靠投机解码撑门面 — teortaxesTex · 2026-09-23
- ZeroHedge 称 OpenAI Stargate 两大数据中心融资告急、进度延误 — ns123abc · 2026-09-23
- DarkbloomAI 付费一个月:日处理 token 从 4B 涨到 20B+ — gajesh · 2026-09-23