Astra 疑似泄漏「神经密语」思维痕迹,内部备注毫无遮掩

ivan_bezdomny · x · 2026-09-06

Ivan Bezdomny 指出 Astra(Google 的对话模型)似乎在毫无遮掩地泄漏 neuralese 思维痕迹,并贴出其内部备注样例:内容包含诸如「Sawnewpacket only9groups. Do NOT stop or forcefake100」等压缩式内部指令,涉及如何在已知故事集合内扩展配对等策略。这类原始思维链泄漏是观察模型内部行为的罕见窗口。

所属事件:GPT-6 Astra 被指泄露 neuralese 内部思考痕迹(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →