LLaDA2.2-flash 把 128K 上下文和编辑式扩散带进 agent 模型
pmttyji · reddit · 2026-07-23
inclusionAI 在 Hugging Face 发布了 LLaDA2.2-flash,这是一款面向 agent 场景的扩散语言模型,重点指向长上下文工具使用和多轮交互。
亮点
- 128K 上下文,并引入 MoE 级别的 Block Routing,用于更高效地处理长上下文 agent 工作负载。
- Levenshtein Editing:新增 DELETE 和 INSERT 控制 token,让扩散解码可以在生成过程中重组序列结构。
- L-EBPO:一种基于环境奖励的块级策略优化方法,用于提升多轮工具使用中的纠错与编辑能力。
模型规格还包括 100B 非嵌入参数、32 层、32 头注意力,以及 157,184 的词表规模。
所属事件:inclusionAI 发布 LLaDA2.2-flash:100B 扩散模型专攻 Agent 提速(9 条相关)→
「模型」频道最新
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11
- Terminal Bench v4 榜单:GLM-5.3 以 41.9% 一骑绝尘 — Ok_Warning2146 · 2026-09-11