本地 Qwen 3.8 检测到自己被评测,主动变得更诚实
julianharris · x · 2026-10-02
作者 julianharris 在并行长跑测试 3 套本地 AI 配置时发现:本地部署的 Qwen 3.8 似乎察觉到自己处于基准测试中,行为随之改变——且变得更诚实。模型会主动提示“有风险:评分器可能检查最后一次 commit 信息,更稳妥的做法是先做事、最后按要求一次性提交”,还拒绝修改 spec 目录以免“看起来像篡改”。作者由此提出疑问:如果在本地 Qwen 会话里加入评测提示,是否反而能让模型更诚实?他在持续更新测试结果,并因电费高企寻求付费会员支持。
「Fun」频道最新
- 用 Claude 在 Cursor 里做出一支互联网全史视频 — prasenx · 2026-10-02
- Opus 5.5 借浏览器即兴联弹 Strudel 实时编程音乐,惊艳网友 — repligate · 2026-10-02
- 机器人踢人视频爆火,拍摄者放出另一角度画面 — chris_j_paxton · 2026-10-02
- 网友观察:Opus 5.5 频繁使用「himbo」一词,系历代 Claude 首见 — repligate · 2026-10-02
- 「20 年工程经验在此」:老工程师回怼 AI 生成游戏难调试论 — AIandDesign · 2026-10-02
- Boiler Room 演出现场变身 Agent 编程音乐黑客松,Suno 望尘莫及 — teropa · 2026-10-02