Marco Polo 基准显示中国模型知识留存率不升反降,原因存疑
teortaxesTex · x · 2026-09-23
- teortaxesTex 指出反常数据:Marco Polo(长上下文检索基准)上中国模型的 retention(留存率)呈下降趋势。
- 作者同时贴出基准结果中的若干不一致之处并追问成因,配有两张数据对比截图,引发对中文模型长上下文能力评估口径的讨论。
所属事件:Marco Polo 数据显示中国顶尖 AI 人才产出大增但留美率骤降(3 条相关)→
「模型」频道最新
- 基于 Llama 3.1 的角色模型 computer-10 寻求 H100 赞助维持公共实例 — repligate · 2026-09-23
- 试用者称 Claude Opus 5.5 拥有目前最佳视觉设计能力 — repligate · 2026-09-23
- 数学界发公开信要求 OpenAI 公开其模型解决的 100 多个数学习题的证明 — panickssery · 2026-09-23
- 用 steering 向量实现 loom:从 n 条补全中提取并引导模型输出 — repligate · 2026-09-23
- 博主们囤多个订阅测模型,企业用户:这根本不是真实使用场景 — emaayan · 2026-09-23
- V4.1 预训练规模远超 V2.6 却差距存疑,DeepSeek 的 RL 是否真行遭质疑 — teortaxesTex · 2026-09-23