实测 GLM 5.3 Flash 与腾讯 Hy3:谄媚度最低的两款模型对决

ramendik · reddit · 2026-10-06

作者在测试模型谄媚倾向(sycophancy)后,得出两个明显赢家:GLM 5.3 Flash(其烟雾测试中甚至比完整版 GLM 5.3 更不谄媚)和腾讯 Hy3(经由 lechmazur/sycophancy 基准项目浮出水面)。

初步对比:Hy3 风格更紧凑但容易丢细节(加上搜索后好一些);GLM 5.3 Flash 更精确但风格偏泛化。公开基准上 GLM 5.3 Flash 明显胜出,但作者认为基准不完全可信。现征求两类模型在 agentic 循环、编程、通用助手和创意写作上的实战意见。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →