LLaDA2.2 把扩散大模型推向智能体任务,支持 128K 上下文自我编辑
alifcoder · x · 2026-07-25
LLaDA2.2 被包装为一个面向 agent 的大规模扩散式语言模型,不只做生成,还能在长、多轮任务里规划、调用工具并自我纠错。
- 核心机制是 Levenshtein Editing:通过 KEEP / SUBSTITUTE / DELETE / INSERT,模型可以重写自己的序列,避免早期错误永久污染上下文。
- L-EBPO 让模型结合环境反馈学习“何时、何处”修正错误,目标是缓解长程任务中的目标漂移和级联失败。
- 还加入了 原生 128K 上下文 和 Block Routing,用于更可控的长上下文推理。
- 在 7 个 agent 基准上,LLaDA2.2-flash 平均 53.83,对比 Ling-2.6-flash 的 55.74;同时在 11 个 workload 上实现了平均 1.64× BF16 吞吐。
所属事件:inclusionAI 发布 LLaDA2.2-flash:100B 扩散模型攻坚 Agent 延迟(8 条相关)→
「模型」频道最新
- Claude Opus 5 上线,编程实测强但基准分数仍有争议 — Latent Space · 2026-07-25
- xAI 将 SuperGrok Heavy 降至每月 99 美元,三个月打 67 折 — ns123abc · 2026-07-25
- 为什么 Bonsai 27B 没进 Artificial Analysis 排名 — ML-Future · 2026-07-25
- Qwen 3.8 Max Preview 在规划、简化和产品视频上表现亮眼 — RevealIndividual7567 · 2026-07-25
- Gemini 旧聊天集体报 1706,新聊天仍可用 — Keithstrombiller · 2026-07-25
- Opus 5 编程分数在 high 以上反而下滑 — hero88645 · 2026-07-25