Kimi K3 推理模式需保留完整消息,多数人用错了
NielsRogge · x · 2026-08-04
Hugging Face 成员 NielsRogge 指出,Kimi K3 训练于保留思考历史的模式,多轮对话和工具调用时,必须将 API 返回的完整 assistant 消息(包括 reasoningcontent 和 toolcalls)原样传回,否则模型无法正常工作。他调侃 99% 的人可能用错了 Kimi K3。
「模型」频道最新
- 调侃 LLM 安全护栏:网友提议开发脏话拦截器 — wavefnx · 2026-08-04
- MiniMax H3 语音模型翻车:西班牙语发音准但胡言乱语 — Redditforgoit · 2026-08-04
- 为何中国大模型前端能力碾压西方?开发者实测引热议 — mouseofcatofschrodi · 2026-08-04
- 实测 DeepSeek 日常任务表现优异,足以替代顶级模型 — yacineMTB · 2026-08-04
- 抛弃 Claude Code:将深度研究工作流迁移至开源模型实战 — TheZachMueller · 2026-08-04
- 实测对比:MMH3 多模态能力优于 Google Omni Flash — Ok-Act-9620 · 2026-08-04