输出概率而非文本的新模型:比 Fable 级模型快 25 倍、便宜 600 倍

danshipper · x · 2026-09-16

Every 创始人 Dan Shipper 透露,团队罕见地测试了一款新基础模型约一周,体验"相当震撼"。该模型不输出文字,而是直接输出概率,因此能高效充当 LLM judge——在需要 Fable 级模型判断的场景中,实测比其快 25 倍、价格低 600 倍。

转发者认为这几乎是"完美的工作流模型":在需要 LLM 评估的 skills 中调用它,可大幅提升 agent 工作流准确性,甚至把整套流程脚本化。Shipper 判断这类能力会在 6-12 个月内变得不可或缺。

所属事件:Every 实测新型模型 Jev:只输出概率,快 25 倍、成本降近 600 倍(7 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →