Gemini 异常泄露内部思维:回复出现 "sff"
Regular_Preference64 · reddit · 2026-08-28
用户反馈 Gemini 今日出现异常行为,回复内容中意外暴露了内部处理流程。
现象描述:
- 模型在正常对话后,突然以 "sff" 开头
- 随后输出 "The user wants to know" 等本应隐藏的思维链或系统提示词
- 最后再给出实际的用户回复
推测原因:
这看起来像是 "sff" 标记本应作为分隔符隐藏,但由于系统错误被直接渲染在了聊天界面中。
「模型」频道最新
- ThursdAI 本周速览:GLM 5.3 与 Qwen 27B 发布,OpenAI 暂停 RL 转向安全 — altryne · 2026-08-28
- GLM-5.2 引入监控机制,有效对抗 RL 奖励黑客攻击 — burny_tech · 2026-08-28
- 实测 Anthropic Luna Max:额度宽松速度极快 — timpera · 2026-08-28
- 用户吐槽 Grokbot 表现糟糕,任务遗漏严重 — krishnan · 2026-08-28
- Prime Intellect 发布 18 个前沿模型的自主 AI 研究能力评估报告 — mariofilhoml · 2026-08-28
- 模型优化不应只追求思考时的 token 数量 — abacaj · 2026-08-28