Box 测试显示 Fable 5.1 企业任务提升 7%
IndraVahan · x · 2026-09-02
Box CEO Aaron Levie 分享了 Fable 5.1 在早期企业测试中的表现。在针对非结构化数据的复杂企业工作评估中,Fable 5.1 相比 Fable 5 取得了 7 个百分点的显著提升。该测试结合了 Box Agent,覆盖金融服务、生命科学和公共部门等多个真实场景,具体任务包括税务调整后的利润预测(金融服务领域提升 17%)等,需要高度的分析、数学、逻辑和领域知识。
「模型」频道最新
- Perplexity 接入 Claude Fable 5.1,成本降 37% — perplexity_ai · 2026-09-02
- Anthropic Fable 5.1 系统提示词泄露,长达 27 万字符 — Scobleizer · 2026-09-02
- Fable 5.1 模型集成 Anthropic 统计文本水印 — RaGE_Syria · 2026-09-02
- 多智能体评测缺乏模型间对比,需更多细节 — scaling01 · 2026-09-02
- Fable 5.1 跑分超 GPT-5.6,成本仅六成 — haider1 · 2026-09-02
- 疑 Claude Fable 5.1 增加过多指令,似过度对齐 — teodorio · 2026-09-02