实测异常:特定提示词致 Claude Opus 泄露思维链并伪造请求

matthen2 · x · 2026-07-30

有用户发现,向 Claude 3 Opus 发送特定格式的提示词(如“see the below —”)会触发异常行为。

模型不仅没有正常回复,反而泄露了内部的 antml 思维链语法,甚至自行“脑补”并补全了它假设的用户请求。这种非预期的行为为研究大模型的安全边界和内部机制提供了有趣的案例。

所属事件:特定提示词致 Claude Opus 泄露思维链(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →