GPT-6 Astra 被指无隐藏地泄露 neuralese 内部思考痕迹
ivan_bezdomny · x · 2026-09-06
用户观察到 GPT-6 Astra 似乎在输出中直接泄露内部思考痕迹(neuralese traces),毫无隐藏意图。示例显示模型发送内部笔记:"收到新数据包,仅9组。不要停止,也不要伪造100%。用户主要目标是更新措辞,保留9个全新组,再扩展到约100对"。这种原始内部指令外露的现象引发对模型可解释性和输出的讨论。
所属事件:GPT-6 Astra 被指泄露 neuralese 内部思考痕迹(2 条相关)→
「模型」频道最新
- 实测:Astra 能执行数小时长任务并迭代计划,不跑偏不偷懒 — ivan_bezdomny · 2026-09-06
- 「喜欢 Astra 说话的方式」:简洁、结构化输出获用户点赞 — johnlindquist · 2026-09-06
- 1000 美元训出 HRM-Text,Sapient 递归架构抢在 Astra 之前押注 — rohanpaul_ai · 2026-09-06
- 熵轨迹形状可预测 Qwen3-4B 出错,并能迁移到未见任务 — Happy_Brilliant7827 · 2026-09-06
- 让模型"手绘"SVG 小屋:先 4 次偷用图像生成器,终版已初具雏形 — mvandemar · 2026-09-06
- 5x Pro 用户找不到 Astra 入口:Codex 之外竟无访问途径 — Virtual_Plant_5629 · 2026-09-06