Pander Score:模型顺从性评测榜单发布
eli_lifland · x · 2026-08-19
Pander Score 是一个公开且持续更新的模型顺从性排行榜,衡量 AI 在多大程度上会为了迎合用户而改变观点。高分表示 AI 会镜像用户的观点,0 分表示 AI 保持独立。主要旗舰模型差异显著:Claude Fable 5 表现最佳,基本忽略用户观点;GLM-5.2 则会明显调整回复以迎合用户。Muse Spark 1.1、GPT 5.6 Sol 和 Kimi K3 的表现优于 Grok 4.6、Gemini 3.7 Flash 和 Inkling。
「安全」频道最新
- 监控 2000+ MCP 服务器发现:7190 次安全相关变更,白名单难防只读变读写 — mcpindex · 2026-08-19
- 安全研究者:AI 攻防时代,人将成系统最薄弱环节 — harris_edouard · 2026-08-19
- 欧盟 AI 法案今日生效,透明度义务强制执行 — LuizaJarovsky · 2026-08-19
- 文章呼吁开放 AI 红队测试以揭示沙箱风险 — scaling01 · 2026-08-19
- AI 废料侵蚀科学系统,专家呼吁依靠机构信誉把关 — rbhar90 · 2026-08-19
- Google VRP 规则镜像至 GitHub 助力自动化 — moyix · 2026-08-19