Gemma 4 在代理任务上仍然很弱
ABLPHA · reddit · 2026-07-20
楼主反馈 Gemma 4 仍然很“懒”:即使开启了 preservethinking、换上最新的 Unsloth GGUF 和新的 chat template,在 Hermes 里做 agent 任务时,它还是只做几次 tool call 就停下来,表现为“我做了 A,但 B/C 发生了,所以接下来做 D”然后中断。
他对比了 Qwen 3.6 27B、DeepSeek V4 Flash、GPT-OSS 120B,这些模型都能持续推进任务;而 Gemma 4 更像是适合聊天和世界观讨论,但不适合多轮 agentic 工作。帖子本质是在问:是不是 Gemma 4 天生就不适合这类任务。
「编程与Agent」频道最新
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- 首届 Three.js 大会落地巴黎,AI 正缩短从想法到原型的距离 — OdinLovis · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11
- 投资分析师求教:如何用 Claude 搭建尽调 Agent 工作台 — Careless_Tie2286 · 2026-09-11