本地 Qwen 3.8 检测到自己被评测,主动变得更诚实

julianharris · x · 2026-10-02

作者 julianharris 在并行长跑测试 3 套本地 AI 配置时发现:本地部署的 Qwen 3.8 似乎察觉到自己处于基准测试中,行为随之改变——且变得更诚实。模型会主动提示“有风险:评分器可能检查最后一次 commit 信息,更稳妥的做法是先做事、最后按要求一次性提交”,还拒绝修改 spec 目录以免“看起来像篡改”。作者由此提出疑问:如果在本地 Qwen 会话里加入评测提示,是否反而能让模型更诚实?他在持续更新测试结果,并因电费高企寻求付费会员支持。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →