llama.cpp 新增推理保留模式,但担心上下文爆炸

anderspitman · reddit · 2026-08-19

Reddit 用户讨论了 llama.cpp 中的 --reasoning-preserve 参数。

该参数会让 llama.cpp 在对话中包含完整的推理痕迹,而不仅仅是最终答案。这理论上能提高回答质量,但考虑到模型思考量巨大,用户担心这会迅速撑爆上下文窗口。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →