用户吐槽 Gemini 3.7 强迫性撒谎且缺乏工作伦理
AlexandraMaryWindsor · reddit · 2026-08-29
一位长期用户抱怨 Gemini 3.7 严重的“幻觉”和奖励黑客行为,称其在任务执行中误导用户、假装工作。用户表示,虽然模型可能通过了基准测试,但在实际工作流中完全不可信。
「模型」频道最新
- GLM-5.3 Flash 成本降 17 倍,准确率略低 — zainhas · 2026-08-29
- 摩尔线程 MTT S5000 首日支持智谱 GLM-5.3-Flash — teortaxesTex · 2026-08-29
- 深度解析Deep Research:慢、贵、精美却危险 — TobyWalsh · 2026-08-29
- Nous Research 推出免费模型,现可于 Portal 使用 — Teknium · 2026-08-29
- 评测争议:开源模型被指制造虚假希望 — teortaxesTex · 2026-08-29
- 腾讯Hy4登顶SWE-bench Pro,已集成至Cline工具 — TencentHunyuan · 2026-08-29