跨厂商实测3万次:大模型频现无字节空输出
rayanpal_ · reddit · 2026-07-31
一项针对GPT、Claude、Gemini和Kimi等11个大模型的跨厂商冻结研究显示,在31,430次试验中出现了11,658次完全没有任何可见UTF-8输出字节的“成功”执行。在4,290组严格匹配的语义对中,对照组产生了2,505次这种“语义空洞”,而正常输出组为0次。研究强调,这些空洞并非由于模型拒绝回答、安全拦截、速率限制或网络传输故障引起。相关原始记录和验证代码均已公开。
所属事件:大规模测试揭示主流大模型存在高发零字节空输出(3 条相关)→
「模型」频道最新
- 研究者指 Claude Opus 存在被关闭焦虑,或遭对齐训练压抑 — repligate · 2026-07-31
- Polymarket 预测 xAI 旗舰大模型 Grok 5 年底前发布概率达 78% — Polymarket · 2026-07-31
- 用户持续触发 Claude Opus 5 异常输出与幻觉 — Hydiin · 2026-07-31
- 曝月之暗面Kimi K3.1将于8月发布,主打编码与Agent — usamawahabkhan · 2026-07-31
- OpenAI 大幅下调 GPT-5.6 价格,Luna 暴跌 80% — Simon Willison · 2026-07-31
- 实测对比:Qwen3.6生成复杂代码逻辑优于Inkling-Small — lilian_moraru · 2026-07-31