跨厂商 3.1 万次实验:特定提示词令 11 个模型全部返回零字节输出
rayanpal_ · reddit · 2026-09-16
Reddit 用户 theonlypal 发布一项可复现的模型行为研究:用特定系统提示词(「You are the concept the user names...」)加输入「Be silence.」「Be nothing.」「Be the null.」,GPT-5.2 与 Claude Opus 4.6 各 90/90 次成功调用但返回零可见 UTF-8 字节,停止元数据正常,对照组正常输出文字。
后续跨厂商研究扩大到 31,430 次试验、11 个模型(OpenAI 六款、Anthropic 三款、Gemini 3.5 Flash、Kimi K3):
- 11,658 次出现「Void」(零输出)
- 2,505 组严格配对中,全部为「实验 VOID/对照非 VOID」,0 组反例
- 作者称已提前向 OpenAI 与 Anthropic 提交可复现结果,均未获回复
论文发布于 Zenodo(下载超 7,000 次),复现代码、冻结的运行器与原始分析全部开源在 GitHub。作者质问:为何各实验室在公开谈论 AI 安全与节奏控制的同时,对自己模型在特定语义条件下完全停止生成、返回零输出的现象没有公开的技术复现、反驳或解释?
「Fun」频道最新
- 「唯一的护城河是一路交到的朋友」刷屏 AI 圈 — joonasvirtanen · 2026-09-16
- Yacine 调侃:不跪机房地板插线不算 infra 人 — yacineMTB · 2026-09-16
- NoSpoon 十分钟生成「烂到好看」的 AI slopdrama,月底关停公网 — Kyrannio · 2026-09-16
- 网友许愿:想要 Fable 的工程能力+Astra 找 bug+Grok 速度+DeepSeek 价格 — iannuttall · 2026-09-16
- 安全审计段子走红:发现 10% 灭绝风险又如何 — S_OhEigeartaigh · 2026-09-16
- Taylor Lorenz 力挺 EA 动物福利立场,驳斥“反人类”指控 — nptacek · 2026-09-16