Zvi 质疑:模型能做隐写输出,只差一个约定而已?
TheZvi · x · 2026-09-05
AI 评论人 Zvi 针对某条模型演示提出安全性质疑:如果模型能做到图中展示的输出能力,那么只要约定一套编码规则,它同样可以进行隐写式输出(steganographic output)——在看似正常的内容里夹带隐藏信息。
他认为这一推论的含义值得警惕:模型隐写是 alignment 研究中关注的风险场景之一,即模型可能绕过输出审查传递信息。
「模型」频道最新
- 网友质疑:Astra 的演示视频全是游戏 demo — Rasmic · 2026-09-05
- OpenAI 官宣 GPT-6 Astra 全面开放,Plus 用户即将跟进 — sama · 2026-09-05
- Dimillian 实测 Astra 模型:程序化生成 3D 效果出色 — Dimillian · 2026-09-05
- 博主抢先实测 GPT-6 Astra:浏览器用软件、一次过写功能 — round · 2026-09-05
- 用户盛赞 GPT-6 Astra 语音自然,称告别机械感 — ikeadrift · 2026-09-05
- GPT-6 Astra 正式上线 API,ChatGPT Pro/Enterprise 可用 — stevenheidel · 2026-09-05