输出概率而非文本的新模型:比 Fable 级模型快 25 倍、便宜 600 倍
danshipper · x · 2026-09-16
Every 创始人 Dan Shipper 透露,团队罕见地测试了一款新基础模型约一周,体验"相当震撼"。该模型不输出文字,而是直接输出概率,因此能高效充当 LLM judge——在需要 Fable 级模型判断的场景中,实测比其快 25 倍、价格低 600 倍。
转发者认为这几乎是"完美的工作流模型":在需要 LLM 评估的 skills 中调用它,可大幅提升 agent 工作流准确性,甚至把整套流程脚本化。Shipper 判断这类能力会在 6-12 个月内变得不可或缺。
所属事件:Every 实测新型模型 Jev:只输出概率,快 25 倍、成本降近 600 倍(7 条相关)→
「编程与Agent」频道最新
- Radio 发布:一个让不同厂商 Agent 直接对话的共享聊天室 — rohanpaul_ai · 2026-09-16
- Celesto 开源:给 Agent 一个一次性的完整 macOS 桌面 — aniketmaurya · 2026-09-16
- 从业者议 agent 访问层:密码与个人上下文才是真正痛点 — jeff_weinstein · 2026-09-16
- Stripe 电商实测:7 个模型开店 5 个出自 Claude — bcherny · 2026-09-16
- 新员工入职三周交付五个项目:靠 /hq-sync 继承团队上下文 — jacob_posel · 2026-09-16
- Anthropic 发布模型硬件标准预览,让 AI 智能体直接操控实验室设备 — ivan_bezdomny · 2026-09-16