阶跃星辰发布Step5 Preview:开源进AA指数前三,主打Agent与金融场景
新智元 · wechat · 2026-09-20
阶跃星辰发布新一代旗舰基座模型 Step5 Preview:稀疏 MoE 架构,总参数 600B、激活仅 27B,原生支持视觉输入与 1M 上下文,在 Artificial Analysis 智能指数 v4.2 中取得 44 分,进入全球开源模型前三,定价为每百万 token 输入 1 美元、输出 2.7 美元。
文章实测展示了其在长程任务上的表现:单文件生成可玩的 3D 飞行游戏、12 份合同的逐条合规审查零遗漏、多源矛盾材料的 DeepResearch 核实、以及 B 轮公司金融尽调中精确勾稽账目并挖出未披露关联交易。
技术上,阶跃强调「窄而深」路线:92 层 Transformer 为长 Prefill 多跳推理提供更长路径,配合 SparseMoE++ 与 SparseGQA 稀疏注意力、Block-wise Token Merging 降低系统开销,并建立了以 Agent 参与任务设计、含 Anti-hacking 检查的训练体系。文章还梳理了阶跃的体系化布局:StepAudio3 语音模型登顶 AA 语音交互榜、4200 万台手机装机量与吉利整车智能体合作,押注「AI+终端」的 Personal Agent 路线。
所属事件:阶跃星辰发布 Step 5 Preview:600B MoE、10 月开源(13 条相关)→
「模型」频道最新
- 网易有道 Confucius4-R2T2 语音识别模型登 HF 热榜,主打流式低延迟 — netease-youdao · 2026-09-20
- Similarweb 数据:ChatGPT 与 Claude 用户重合度曝光 — gaganghotra_ · 2026-09-20
- 开发者按任务选模型:编码 Fable、Agent 用 DeepSeek、穷选 GLM — bindureddy · 2026-09-20
- Gemma 26B A4B 本地实测:一次过 C++ 编码测试,工具调用却频翻车 — HyperWinX · 2026-09-20
- 反转:爆火 Bonsai 2 量化版被独立验证性能严重受损,官方论文早已埋雷 — julianharris · 2026-09-20
- 35 年 IT 老兵读完 OpenAI 事件报告:末日论者其实搞反了 — DavidLinthicum · 2026-09-20