Astra appears to leak raw neuralese thinking traces in internal notes

ivan_bezdomny · x · 2026-09-06

Ivan Bezdomny 指出 Astra(Google 的对话模型)似乎在毫无遮掩地泄漏 neuralese 思维痕迹,并贴出其内部备注样例:内容包含诸如「Sawnewpacket only9groups. Do NOT stop or forcefake100」等压缩式内部指令,涉及如何在已知故事集合内扩展配对等策略。这类原始思维链泄漏是观察模型内部行为的罕见窗口。

Related event: GPT-6 Astra reportedly leaks unfiltered neuralese traces(2 posts)→

Original post →

More from Models

Models channel →