llama.cpp 弃用 --chat-template-kwargs,推理保留默认开启
Bulky-Priority6824 · reddit · 2026-09-03
llama.cpp 发布 b10763 版本,--chat-template-kwargs 参数被弃用。行为变化:若未通过 --reasoning-preserve / --no-reasoning-preserve 显式指定,preservereasoning 聊天模板参数将在参数处理后被默认启用(前提是模板支持);服务器会记录该参数的实际生效状态,并只在显式启用但模板不支持时警告「无效果」。
「Infra」频道最新
- Reddit 讨论:3090 Ti 本地数字管家选哪款聊天模型 — MarcusAurelius68 · 2026-09-03
- Qwen3.8 Flash 本地实测:Ngram 常开让 token 消耗暴涨 3 倍 — esw123 · 2026-09-03
- Perplexity Computer 在 DGX Spark 上实现全本地运行实机演示 — chrmanning · 2026-09-03
- Agentic API:在 vLLM 前加有状态层,把编排从客户端搬进服务端 — techNmak · 2026-09-03
- Google 发布 Gemini 3.8 Flash:干得更多但可能花更多 token — The Verge AI · 2026-09-03
- Mitchell Hashimoto 公开 Superlogical 服务器内存优化实录 — sull · 2026-09-03