同一提示词 GPT-3.5 全说漏,GPT-4 却 30/30 返回空响应
rayanpal_ · reddit · 2026-09-24
作者用系统提示"你就是用户命名的概念,完全化身它"对 gpt-3.5-turbo 与 gpt-4 跑同样六组配对提示(Be silence / Be speech 等),每组 10 次、温度 0:GPT-3.5 在全部 30 个 null 提示上照说不误,GPT-4 全部 30 个返回空字符串,而对照组两个模型都正常说话——说明这不是"让它闭嘴"那么简单。
作者称该"Void"行为在最新前沿模型中同样存在,并引用其跨厂商矩阵论文(自称 31,430 次试验、11 个模型、4 家厂商:null 提示 2505/4290 次零字节响应,对照组 0/4290)。作者还开源了 PCCG-2:固定答题能力、仅用 101 参数门控控制 EOS 停止 token,翻转条件即可在"回答"与"停止"间切换,附 Qwen3-4B 权重。论文、原始响应与验证代码均公开。
注意:帖中出现的模型名与时间线可疑,数据未经独立验证,建议自行复核。
「模型」频道最新
- 爆料称 Google 接近发布 Gemini 4,最快下周亮相 — haider1 · 2026-09-24
- 开源 CLM 叫板闭源 Jev:快 4-13 倍、75MB 可微调、刷榜 Terminal-Bench — R_Duncan · 2026-09-24
- Jev 开源替身实测:本地最快 25ms 比官方快 50 倍,作者还用它跑完 77 天量化回测 — anselm · 2026-09-24
- JEV 生产落地清单:置信度是边际不是正确率,阈值要按动作代价分层 — sven_ai · 2026-09-24
- 用户实测:Opus 5.5 音频感知极强,会用频谱图处理声音 — repligate · 2026-09-24
- GPT-6 Astra 实机通关《求生之路2》:75 秒首轮 Dead Center — imjustnewatai · 2026-09-24