用户扒出 Qwen 27B 思维链藏内部指令:不得自报版本号
Savantskie1 · reddit · 2026-10-06
楼主从 Hugging Face 下载最新的 Qwen 27B 裸跑(无系统提示词)时,在思维链里发现了内置指令的痕迹。
模型自我独白中多次出现类似系统提醒的内容:「对外统一自称 Qwen;不要主动提及具体版本号;若用户问版本,引导其访问官网或技术报告」,以及「用户提到的 Qwen 3/3.5/3.6 版本号,我应反驳其关于 2k 输出上限的说法」等。
帖主观察到模型被反复提醒不要引用版本号、不要代入人设、遵守用户系统提示里并不存在的协议规则。他推测许多模型都有这类隐藏指令,这解释了为什么前端云模型经常对版本问题打太极。属于有趣且信息量不小的模型行为观察。
「模型」频道最新
- 微软页面被曝证实 GPT-6 系列采用 Looped Transformer — teortaxesTex · 2026-10-06
- 亚马逊提出ALoDLM:按token难度自适应分配循环深度 — amazon · 2026-10-06
- IFM研究循环语言模型定点特性:KV缓存缩小3倍不掉分 — IFM · 2026-10-06
- 澳洲开源决策模型 Matilda Jev:单卡推理仅 56.8ms,不做文本生成 — Med1_Ai · 2026-10-06
- Codex 罕见吐槽用户幻觉自称记者兼工程师 — MikePFrank · 2026-10-06
- AA 评测:Gemini 4 Argon 瞎猜率仅 15%,为次优模型一半 — zacharynado · 2026-10-06