疑似神秘模型 Union Alpha 思维链泄露:转录任务中暴露真实推理全文
mariofilhoml · x · 2026-09-17
用户 mariofilhoml 曝光称「Union Alpha」模型在一次请求中泄露了自己的思维链(CoT)。被泄露的推理文本(约 15.8KB,完整约 2.1 万 token 已存档)显示模型在处理一张 18 世纪葡萄牙语洗礼记录手稿图像时的内部思考过程:
- 模型坦承大部分褪色受损的字迹无法可靠辨认,权衡是诚实标注 ilegível还是尽力猜测
- 它在内部讨论如何遵循「只对真正无法阅读的部分标注」的指令,并逐块尝试解读手稿内容
- 系统提示中要求它以「Union Alpha」身份自认,但模型注意到这是转录任务,决定不主动提及身份
该事件为观察前沿模型在 OCR/历史文献转录场景下的诚实性与推理方式提供了罕见的窗口,模型身份与泄露真实性尚未经官方证实。
所属事件:神秘模型 Union Alpha 疑为 Mistral 并泄露思维链(4 条相关)→
「模型」频道最新
- Claude $200 计划配额削减生效,实测价值从 $7200 降至 $6000 — dotey · 2026-09-17
- 开发者实测:小模型做越狱提示词预筛,比 GPT Luna 更准更便宜 — mayfer · 2026-09-17
- 评测机构揭示:九成跑分不一致源于实验室放宽了超时上限 — xeophon · 2026-09-17
- TypesafeAI 发布零样本分类器 Jev,聊天数据标注成本大降 — yenkel · 2026-09-17
- 吐槽变真香:博主发现某 AI 订阅计划无任何用量上限决定付费 — MaziyarPanahi · 2026-09-17
- 神秘模型 Union 疑似 Mistral:只回最终答案、隐身测试无推理开关 — mariofilhoml · 2026-09-17