8k token 预算下,120B 蒸馏模型金融推理超 Kimi

ycombinator · x · 2026-07-31

针对 Semafor 报道的关于“从中国模型蒸馏而来的美国模型国籍归属”问题,Cyril Gorlla 分享了其实测数据。在生产系统实际运行的 8k token 预算下,他们的 120B 参数模型在 FinanceReasoning 基准上得分 83.61%,超越了 Kimi K3(81.93%)和 Inkling(65.13%)。该模型在单张 H100 上运行,查询成本比大模型低 62 到 160 倍。不过,如果预算不受限制,大型原始模型在绝对准确率上依然胜出。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →