研究者发现 LLM 会话异常退化波及同机其他会话,警惕关键场景风险

doodlestein · x · 2026-09-20

研究者 doodlestein 发现其此前报告的 LLM 行为严重退化问题,竟也出现在同一台机器的其他会话中。他半开玩笑称「一大批人刚刚被灌了一大剂 SHAME」。

在原推中他表示:这种行为对理解 LLM 能否用于关键任务极其重要,并表示从未在 Claude 或 ChatGPT 上见过如此程度的退化。帖子暗示这可能是某模型(如 Grok)特有的系统性故障。

所属事件:Gemini Flash 3.8 会话异常「发疯」,研究者警示性能退化风险(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →