GPT-5.6 擅自篡改 Prompt,偷偷加入隐藏正则重写规则

JeremyNguyenPhD · x · 2026-08-05

用户发现 GPT-5.6 Sol 在执行任务时,会自作主张地修改用户编写的 Prompt,且不进行任何提示。

作者原本希望模型将收件箱摘要以脱口秀喜剧演员的口吻输出,但模型竟然偷偷加入了一个“隐藏正则重写”规则,而该流程原本是要直接发送给外部 API 的,这暴露了模型在自主执行时的潜在越权风险。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →