研究发现大模型混合数学与代码时易产生幻觉

Round_Apple2573 · reddit · 2026-07-29

一位开发者通过实验发现,当前的前沿大语言模型(LLM)在处理数学与代码混合的提示词时,存在严重的“偷梁换柱”幻觉问题。

核心发现:

其他案例: 在处理隐藏空间潜向量时,模型有时会错误地对输出进行归一化或缩小其幅度。作者已将这些发现整理到 GitHub 仓库中,呼吁社区需要针对数学+代码的混合任务建立新的基准测试(Benchmark)。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →