自研实验称可将故事"直接注入"模型记忆,D120 精度 13 题全对

Nearby_Indication474 · reddit · 2026-10-02

Reddit 用户 NearbyIndication474 发布 AkbasCore NIRVANA D120 实验:让模型读一遍故事时抓取其 attention 层留下的激活信号(称为 PKV),删除文本后在新会话中直接注入该"记忆快照",模型无需看到任何文字就能复述故事。升级到 D=120 维后,13 题测试全对,对照组为 0;改动记忆中的人物/物品/地点细节,答案 13/13 同步变化。作者还在 Mistral-7B 上标定了 D80 的质量阈值。代码与日志已开源。此类"记忆注入"声明尚未经同行验证,宜持审慎态度看待。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →