跨厂商实测3万次:大模型频现无字节空输出

rayanpal_ · reddit · 2026-07-31

一项针对GPT、Claude、Gemini和Kimi等11个大模型的跨厂商冻结研究显示,在31,430次试验中出现了11,658次完全没有任何可见UTF-8输出字节的“成功”执行。在4,290组严格匹配的语义对中,对照组产生了2,505次这种“语义空洞”,而正常输出组为0次。研究强调,这些空洞并非由于模型拒绝回答、安全拦截、速率限制或网络传输故障引起。相关原始记录和验证代码均已公开。

所属事件:大规模测试揭示主流大模型存在高发零字节空输出(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →