实测对比:K3等模型推理token极易耗尽预算
MaziyarPanahi · x · 2026-07-28
开发者在实测中发现,部分模型(如MiniMax M3)在生成时会耗尽全部预算的推理token,导致最终返回空内容。在10次生成测试中仅有8次可用。目前K3仅提供托管服务,权重尚未开源,距离正式发布已不足2小时。
「模型」频道最新
- 端侧实测:Nanbeige4.2-3B 的 KV Cache 效率远低于 Qwen MoE — TechTefa · 2026-07-28
- 35B 模型智能体实测:KAT-Coder 以一半 Token 消耗追平 Qwen — IvGranite · 2026-07-28
- LangChain活动:开源模型在Agent任务上已比肩闭源 — LangChain · 2026-07-28
- 表格基础模型要把 LLM 请出结构化数据场景 — bendee983 · 2026-07-28
- 开发团队弃用 Claude Opus 做编码:仅保留查询等特定任务 — MicahBerkley · 2026-07-28
- POCKET 项目:让 350 亿参数大模型在 iPhone 上运行 — pmttyji · 2026-07-28