自研实验称可将故事"直接注入"模型记忆,D120 精度 13 题全对
Nearby_Indication474 · reddit · 2026-10-02
Reddit 用户 NearbyIndication474 发布 AkbasCore NIRVANA D120 实验:让模型读一遍故事时抓取其 attention 层留下的激活信号(称为 PKV),删除文本后在新会话中直接注入该"记忆快照",模型无需看到任何文字就能复述故事。升级到 D=120 维后,13 题测试全对,对照组为 0;改动记忆中的人物/物品/地点细节,答案 13/13 同步变化。作者还在 Mistral-7B 上标定了 D80 的质量阈值。代码与日志已开源。此类"记忆注入"声明尚未经同行验证,宜持审慎态度看待。
「研究」频道最新
- SECRET 免训练法缓解音视频大模型跨模态幻觉,最高提升 18 个百分点 — Yu Zhang · 2026-10-02
- 美团 LongCat 提出 N-OPSD:邻近专家池自蒸馏,AIME 均值最高提升 2.75 分 — meituan-longcat · 2026-10-02
- DMM 迭代意图去噪解多智能体寻路,1600 任务解决 1598 并扩展到百万智能体 — Valeriy Vyaltsev · 2026-10-02
- ProVer 论文:让 LLM 裁判定位关键步骤,Agent RL 超 GRPO 9.9% — omarsar0 · 2026-10-02
- 哥本哈根大学招募无分词语言模型方向博士生,办公室设在植物园天文台 — delliott · 2026-10-02
- Memorizon:流式世界模型跨重访训练,长跨度只增 12% 步时成本 — MBZUAI-IFM · 2026-10-02