LLaDA2.2-flash 把 128K 上下文和编辑式扩散带进 agent 模型
pmttyji · reddit · 2026-07-23
inclusionAI 在 Hugging Face 发布了 LLaDA2.2-flash,这是一款面向 agent 场景的扩散语言模型,重点指向长上下文工具使用和多轮交互。
亮点
- 128K 上下文,并引入 MoE 级别的 Block Routing,用于更高效地处理长上下文 agent 工作负载。
- Levenshtein Editing:新增 DELETE 和 INSERT 控制 token,让扩散解码可以在生成过程中重组序列结构。
- L-EBPO:一种基于环境奖励的块级策略优化方法,用于提升多轮工具使用中的纠错与编辑能力。
模型规格还包括 100B 非嵌入参数、32 层、32 头注意力,以及 157,184 的词表规模。
「模型」频道最新
- NVIDIA 在 Hugging Face 发布 JEPA-DNA 基因组基础模型 — _akhaliq · 2026-07-23
- Cisco 推出 Antares:用于定位代码漏洞的双规模小模型 — NielsRogge · 2026-07-23
- Reddit 用户称 ChatGPT Pro Lite 的 Codex 周额度从 675 美元降到 600 美元 — RealSuperdau · 2026-07-23
- Anthropic 近几个月发布混乱:Fable 5 被撤、Sonnet 5 跑输旧版 — haider1 · 2026-07-23
- OpenAI 应用截图曝出 GPT-5.6 Sol、o3 和 effort 控件 — jdjohnson · 2026-07-23
- OpenAI 传 Codex 将加入实时语音与个人助理层 — tinyfool · 2026-07-23