自研记忆工具登顶:LoCoMo基准实测超微软Memora
corbymatt · reddit · 2026-08-14
作者对其开发的记忆工具 Recordari 进行了基准测试,在微软研究院提出的 LoCoMo 数据集上取得了 0.831 的准确率,优于微软 Memora 公布的 0.801。
测试细节与亮点:
- 测试完全使用了 Memora 开源的评测框架,未做任何修改,保证了公平性。
- 在多会话问题(multi-session questions)中,Recordari 取得了 0.869 的高分,远超原始存储基线的 0.760。
- 评测直接调用生产环境的真实 API(基于 MCP 协议的搜索与召回),而非模拟后端。
Recordari 兼容 Claude、ChatGPT 等主流智能体,作者已开源全部测试结果,并提供了匿名沙箱供开发者自行验证。
「编程与Agent」频道最新
- Arcee 开放模型 API 测试版上线,整合 DeepSeek 与 Kimi 等 — latkins · 2026-08-14
- WebDev Arena 榜单:Claude Opus 5 Max 领跑前端开发 — arena · 2026-08-14
- Arcee AI 开源长任务智能体框架 NAC — latkins · 2026-08-14
- Firecrawl 索引收录 4100 万篇生命科学论文 — devdigest · 2026-08-14
- Vercel AI Gateway 原生集成 Exa 搜索,8月底前免费 — TheIshanGoswami · 2026-08-14
- Hermes 大幅扩展 Agent 插件系统,引入事件总线与安全机制 — Teknium · 2026-08-14