Imprint Reader:让模型用自然语言解读自身权重更新

Guanxu Chen · hf · 2026-09-29

研究者提出 Imprint Reader,训练模型用自然语言描述被冻结的权重更新——探索模型能否像人类一样「反思自己的学习过程」,而权重层面恰好留下了可直接检查的学习痕迹。

核心方法与结果:

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →