LLaDA2.2-flash 发布:100B MoE 扩散模型,支持 128K 上下文
QuixiAI · x · 2026-07-24
inclusionAI 发布了 LLaDA2.2-flash,一款面向 agent 场景的 100B MoE diffusion 语言模型。
这次发布的关键信息包括:128K 上下文、用于平行解码的 Levenshtein Editing(插入/删除式编辑)、以及提升长上下文效率的 Block Routing 和 L-EBPO。帖子还称,它在 τ²-Bench、PinchBench、MCP-Atlas 上优于 Ling-2.6-flash,并在报告测试中实现了 1.7×–2.3× 的吞吐提升;许可证为 Apache 2.0。
所属事件:inclusionAI 发布 LLaDA2.2-flash:100B 扩散模型专攻 Agent 提速(9 条相关)→
「编程与Agent」频道最新
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11