大规模测试揭示主流大模型存在高发零字节空输出

一项针对 GPT、Claude、Gemini 和 Kimi 等 11 款主流大模型的跨厂商冻结测试揭示了一项异常现象。在总计 31,430 次试验中,有 11,658 次执行虽然显示成功,却返回了完全没有任何可见 UTF-8 字节的空内容,占比高达约 37%。这种被称作“语义空洞”的零字节空输出问题,在各大厂商模型中普遍存在。

2026-07-31 ~ 2026-07-31 · 3 条相关