基准分差源于围栏:Fable 与 Mythos 模型权重相同

eyishazyer · x · 2026-09-02

对比数据显示,Fable 5.1 和 Mythos 5.1 使用相同的模型权重。两者在 Terminal-Bench 4.0 上的得分差距(55.8 vs 60.9)完全归因于安全围栏的不同,而非模型变得更聪明。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →