Every 推出输出概率的评审模型:比 Fable 快 25 倍、成本低 600 倍
danshipper · x · 2026-09-16
Every 团队与 @typesafeai 合作测试了一种新型基础模型:它不生成文字,而是输出概率,定位为知识工作的「代码 linter」。
- 可用作评审(judge):检查代码是否符合标准、文章是否有 AI 腔、推文是否值得读
- 实测中读完作者全部历史文章并在 1 秒内检查 21 种 AI 写作特征
- 相比 Fable 完成同类任务快约 25 倍,成本低约 600 倍
作者称这类非生成式基础模型很少令人印象深刻,并推荐了 @hammermt 的实测文章。
所属事件:TypeSafe 新模型只输出概率,速度提升 25 倍成本降近 600 倍(4 条相关)→
「模型」频道最新
- Cartesia 新语音模型家族获赞:WER 之外提出语境正确性评测思路 — buckymoore · 2026-09-16
- 网友复现评测:GPT-Astra 无思维链计算能力出现质的飞跃 — dhadfieldmenell · 2026-09-16
- Anthropic Astra 成消费金额榜首,OpenAI Luna 以代币用量大幅领先 — gdb · 2026-09-16
- DeepSeekMath-V2 把验证做成产品:验证算力随生成器一起扩展 — le_james94 · 2026-09-16
- ChatGPT Plus「Work Projects」失联 bug 三天未修,OpenAI 却已关单 — OnwardUpwardForward · 2026-09-16
- 曝 Google 打造数学特化模型 Gemini DeepThink Mathematica — basedjensen · 2026-09-16