Upstage 发布 Solar Mini 4:3B 激活参数拿下 Intelligence Index 24 分
ArtificialAnlys · x · 2026-10-01
- 韩国公司 Upstage 发布专有推理模型 Solar Mini 4,报告称 35B 总参数、3B 激活参数,在 3B 激活参数以下模型中创下 Artificial Analysis Intelligence Index 的帕累托最优点。
- 得分 24,比上代旗舰 Solar Pro 3(8 分)高 16 分,比同激活参数的 Qwen3.6 35B A3B 高 6 分,超过 55B 激活的 Nemotron 3 Ultra 1 分。
- 长上下文推理是强项:AA-LCR v1.1 得 83%,与 MiniMax-M3、GPT-6 Luna (max) 持平;SciCode 得 48%。但智能体编码偏弱:Terminal-Bench 4.0 仅 1%,AutomationBench-AA 22%。
- 输出快但啰嗦:208 tokens/s(快于 GPT-6 Luna max 的 152),但每任务平均输出 88k tokens,单任务约 7.1 分钟;每任务成本约为 GPT-6 Luna (max) 的 5 倍。知识准确率低(AA-Omniscience -11),但拒答率高、非幻觉率 64%。
- 其他规格:1M 上下文、262k 最大输出、仅文本、知识截止 2026 年 2 月,定价 $0.10/$0.40 每百万输入/输出 tokens,闭源不公开权重。
所属事件:Upstage发布Solar Mini 4:3B激活参数模型智能指数达24分(3 条相关)→
「模型」频道最新
- 博主实测 Muse:友好听话但很笨,瞬间忘记格式要求 — ivan_bezdomny · 2026-10-01
- 曝 Claude Sonnet 5.5 实测 120-130tps,跑分全绿但未证实 — julianharris · 2026-10-01
- OpenAI 官员称 GPT-6.1 Sol 需求史上最高,速度将翻倍 — pvncher · 2026-10-01
- 用 GPT-6 Astra 6 小时破解拿破仑将军 217 年未解密码 — arthurcolle · 2026-10-01
- 网友算账:OpenAI 额度 20x 砍到 10x,实为把用户逼向新模型 — CtrlAltDwayne · 2026-10-01
- Gemini 4 Argon 登顶 APEX-Agents:首个 Pass@1 超 80% 的模型 — xennygrimmato_ · 2026-10-01