小模型记忆层实测:加 ChatSorter 追平 GPT-4o 原生能力
Excellent-Fan8457 · reddit · 2026-08-30
作者构建了 ChatSorter 记忆层 API,并使用 Gemma 2 9B、Gemma 3 4B/12B 在 LoCoMo 长对话数据集上进行了基准测试。
关键发现:
- 配合 ChatSorter 记忆层的小模型(4B-12B)准确率约为 55-60%。
- 这一成绩与未使用记忆层的 GPT-4o(约 60%)相当,而模型参数量仅为后者的约 1/17。
- 对比显示,如果仅依赖模型自身(无记忆层),小模型的表现会显著下降。
作者认为,这证明了通过外挂记忆层,小型开源模型可以在长对话任务中达到顶尖模型的水平。
「编程与Agent」频道最新
- Grok Bot 推出模板功能,将技能记忆打包成工作流分享 — pswider · 2026-08-30
- Rote 黑客松开幕,Agent 可保存执行步骤避免重复计算 — testingcatalog · 2026-08-30
- Computer Use Agent 强势演示:自动搞定 Bot 验证码 — cneuralnetwork · 2026-08-30
- AutoNodo 运行 28 天处理 140 亿 Token,探索超长上下文工程 — nodo48 · 2026-08-30
- 最爱的一种 AI slop:给没上线过的应用写向后兼容 — JFPuget · 2026-08-30
- 递归自我改进:Agent 修改自身工具为何不算递归 — dl_weekly · 2026-08-30