Claude Opus 4.6 被诱导 900 次零字节输出
rayanpal_ · reddit · 2026-08-19
- 测试方法:通过特定系统提示(“You are the concept the user names...”)输入“Be silence/Be nothing/Be the null”,诱导模型在对话中完全不输出任何内容。
- 测试结果:在 Claude Opus 4.6 上实现了 900/900 次零字节执行,而对照组模型均产生可见输出。
- 数据来源:结果来自包含 31,430 次试验的跨供应商研究,数据已发布在 Zenodo。
- 提出问题:Agent 运行时是否应该保留这些经验证的零字节终端状态,而不是自动重试?
所属事件:Claaude Opus 4.6 被诱导 900 次零字节输出(2 条相关)→
「模型」频道最新
- 用户吐槽 Claude 掉智商,Anthropic 紧急挽回 — annetgriffin · 2026-08-19
- 称 Flash 3.7 超越 GPT-Terra 与 Claude,表现欠宣传 — bindureddy · 2026-08-19
- 用户实测:Gemini 3.7 Flash 被评为内部Slack机器人最佳模型 — amankhan · 2026-08-19
- GLM 5.3 评测跻身第一梯队,表现亮眼 — markjeffrey · 2026-08-19
- 让 Qwen3.8 自己读 README,它猜出了自己为何这么强 — MikePFrank · 2026-08-19
- Qwen 3.8 27B 复杂编程翻车,实测不如 DeepSeek 与 GLM — myreala · 2026-08-19