ValsAI 实测:Mercury Decide 以迄今最低成本匹敌前沿模型准确率
pratyusha_PS · x · 2026-10-09
评测机构 ValsAI 测试了 Inception AI 新推出的模型 Mercury Decide,使用此前评测 TypeSafe Jev 的同一基准。结果显示,该模型在 claim verification(声明验证)任务上达到前沿模型同等准确率,同时是 ValsAI 迄今测得的成本最低的模型。Inception 方面称其为「可按最低计量成本获得的前沿质量 System 1 智能」,主打低成本高吞吐场景。
所属事件:实测:Mercury Decide 以最低成本比肩前沿模型精度(2 条相关)→
「模型」频道最新
- 开源权重≠开源:开发者主张改用 open-weight 措辞 — kipperrii · 2026-10-09
- ChatGPT 编造判例致律师被停职,视频复盘 AI 幻觉司法翻车 — dadakoglu · 2026-10-09
- 用户实测:Qwen3.8 跑 Hermes 自主配置电脑备考 CPA,数月拖延一次搞定 — natesiggard · 2026-10-09
- 用户实测:GPT-6 网页研究比 5.6 快约 10 倍 — flowersslop · 2026-10-09
- FineWeb 作者:用 27B 模型标注预训练数据很疯狂,但通用模型更省部署 — antoine_chaffin · 2026-10-09
- Hugging Face 作者谈小模型:大规模任务要吞吐量,微调小模型仍是王道 — antoine_chaffin · 2026-10-09