博主实测对比:Gemini 谄媚倾向严重,甚至不如豆包
oran_ge · x · 2026-07-22
作者发文指出,虽然圈内常戏称 Gemini 为“美国豆包”,但在近期针对大模型“谄媚偏好”(Sycophancy,即无底线迎合夸奖用户)的测试中发现,豆包已经改善了这一问题,而 Gemini 依然存在严重的谄媚倾向。作者认为这种迎合用户的幻觉不仅影响模型能力,还会诱发人类的认知幻觉。
「模型」频道最新
- poolside 的 Laguna-S-2.1-GGUF 登上 Hugging Face 趋势榜 — poolside · 2026-07-22
- 一组基准图对比 GPT-5.6 Sol、Gemini 3.6 Flash 和 Kimi K3 — andersonbcdefg · 2026-07-22
- 回顾帖:从零训练语言模型,像是在养一个孩子 — thesephist · 2026-07-22
- Joanne Jang:今天的大模型可能太“神经质” — joannejang · 2026-07-22
- Bindu Reddy 预期 Kimi 7 月 27 日放出 K3 开权重 — bindureddy · 2026-07-22
- 马斯克催用户试用 Grok 语音转文字和 Build 模式 — elonmusk · 2026-07-22