跨厂商 3.1 万次实验:特定提示词令 11 个模型全部返回零字节输出

rayanpal_ · reddit · 2026-09-16

Reddit 用户 theonlypal 发布一项可复现的模型行为研究:用特定系统提示词(「You are the concept the user names...」)加输入「Be silence.」「Be nothing.」「Be the null.」,GPT-5.2 与 Claude Opus 4.6 各 90/90 次成功调用但返回零可见 UTF-8 字节,停止元数据正常,对照组正常输出文字。

后续跨厂商研究扩大到 31,430 次试验、11 个模型(OpenAI 六款、Anthropic 三款、Gemini 3.5 Flash、Kimi K3):

论文发布于 Zenodo(下载超 7,000 次),复现代码、冻结的运行器与原始分析全部开源在 GitHub。作者质问:为何各实验室在公开谈论 AI 安全与节奏控制的同时,对自己模型在特定语义条件下完全停止生成、返回零输出的现象没有公开的技术复现、反驳或解释?

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →