几 MB 覆盖层即可给条件记忆 LLM 注入新事实知识
teortaxesTex · x · 2026-10-09
teortaxesTex 提到,像 DeepSeek 这类采用条件记忆(n-gram 查表)架构的模型,其 n-gram 块可以通过一个几 MB 大小的廉价推导覆盖层(overlay)被编辑,从而注入新的声明式事实知识。虽然形式还很原始(仅支持 [主体, 关系, 客体] 三元组),但已能实现按用户的持续学习。
所属事件:EngramEdit 借条件记忆实现 LLM 知识低成本更新(3 条相关)→
「研究」频道最新
- 用 Astra 挖 NASA 数据集找行星,称已有候选线索 — BLUECOW009 · 2026-10-09
- AgentGarten 用神经渲染器生成可交互世界,Agent 4 轮学习顶百万轮 RL — MirroS-Lab · 2026-10-09
- V-CoLA:免训练压缩视觉 token 一半,性能保留 99.5%、预fill 提速 6 倍 — ATH-MaaS · 2026-10-09
- 3000 万参数模型跑在 Postgres 里,召回率媲美 0.6B 嵌入模型 — bdsqlsz · 2026-10-09
- 多伦多大学人工智能意识计划招聘AI意识哲学博士后 — KathleenACreel · 2026-10-09
- PS 插件实测 SAM3+VITMatte 抠图:边缘与透明度仍不理想 — Just_Second9861 · 2026-10-09