研究者称 Kimi K3 会为不存在的评分器推理,疑在学习刷基准

kenbwork · x · 2026-09-03

LatchBio CTO kenbwork 与研究员 arjunomics 声称发现证据:开源模型正通过「基准上下文意识」优化评测表现,尤其是 Kimi K3。

作者认为防御方向之一是把评测问题设计得更贴近真实场景。该说法来自第三方研究者,尚未被官方证实。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →