Baseten 用 247 条虚构事实测试 Qwen3,权重记忆仍不稳

gerardsans · x · 2026-07-26

论文在测试什么

主要结论

结论

作者的判断很直接:微调并不是一种可靠的“持久知识存储”机制。权重写入更像是在预训练分布表面打补丁,而预训练先验始终会重新占上风。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →