Qwen3.8-27B 推理预算设置与 llama.cpp 实现讨论
Thin_Pollution8843 · reddit · 2026-08-24
用户讨论了 Qwen3.8-27B 模型在使用 reasoning budget 功能时遇到的问题:模型有时思考过深,触及 128k 输出上限。帖子对比了 Qwen 官方文档中的 thinkingbudget 配置与 llama.cpp 的 --reasoning-budget 参数实现(含结束提示词),以及在 pi 插件层面的不同实现方式,寻求更通用的解决方案。
「编程与Agent」频道最新
- 用 Grok Bot 组建 6 人智能体团队,全自动运营公司 — elonmusk · 2026-08-24
- Parsewave 工作揭示 LLM 评估难点:需模拟真实工程环境 — trashnash007 · 2026-08-24
- 语音 AI 提示词实战:8 模块结构与避坑指南 — DeskCaller_AI · 2026-08-24
- Agent 自主发现 Apify 并完成 x402 支付购数据 — markjeffrey · 2026-08-24
- Agent Bubbles 进行强化学习:字节码 VM 与栈编译器 — cephaloform · 2026-08-24
- Agent 框架参数 fork_turns=all 致大量数据复制 — chaumian · 2026-08-24