GPT-6 Astra 被指无隐藏地泄露 neuralese 内部思考痕迹

ivan_bezdomny · x · 2026-09-06

用户观察到 GPT-6 Astra 似乎在输出中直接泄露内部思考痕迹(neuralese traces),毫无隐藏意图。示例显示模型发送内部笔记:"收到新数据包,仅9组。不要停止,也不要伪造100%。用户主要目标是更新措辞,保留9个全新组,再扩展到约100对"。这种原始内部指令外露的现象引发对模型可解释性和输出的讨论。

所属事件:GPT-6 Astra 被指泄露 neuralese 内部思考痕迹(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →