开源 5.3B 决策模型 Aplomb 1:1M 上下文多模态,4B 级榜首
empiriolabsai · reddit · 2026-10-07
EmpirioLabs 发布开源权重决策模型 Aplomb 1(5.3B,基于 Qwen3.5-4B):单请求读入最多 1M token 的文本/图像/视频/音频,返回工具选择与各参数概率,agent 可高置信自动执行、低置信上交大模型。Decision Index 0.2.1 得 44.86,4B 级第一;38 项 benchmark 中 8 项为 ≤5.3B 最高,含 MMLU-Pro、GPQA Diamond、BBH。自研推理运行时把 1M token 全文决策从约 111 秒压到约 3 秒;API 输入 $0.02/1M token,输出免费,默认 ZDR,兼容 OpenAI/Anthropic/Gemini 格式。bf16 下约 12GB 显存可跑,许可对研究/个人及年收入低于 $1M 的公司免费。需注意训练数据含 38 项 benchmark 中 WinoGrande 与 ContractNLI 的公开训练集。
所属事件:EmpirioLabs 开源 5.3B 决策模型 Aplomb 1,支持 1M 上下文多模态(2 条相关)→
「模型」频道最新
- Ollama 上架 Google EmbeddingGemma 2:740M 多模态嵌入模型 — ollama · 2026-10-07
- Reddit 用户吐槽 ChatGPT 频繁误判违规:"对不起,戴夫"式拒绝越来越多 — Crixusgannicus · 2026-10-07
- Runware API 上线两款内容审核模型,政策用自然语言描述即可 — aziz4ai · 2026-10-07
- Ethan Mollick 提醒 AI 实验室:先确保自家模型会用自家产品 — emollick · 2026-10-07
- OpenAI 推出 Decisions API 公测:比 GPT-6 Luna 快 10 倍替应用做决策 — OpenAIDevs · 2026-10-07
- Cloudflare 开源视觉决策模型 clef,速度惊艳引热议 — michellechen · 2026-10-07