谷歌 DiffusionGemma:仅用 10% 预算改造大模型,并行生成提速至 1500 tokens/s
The Decoder · rss · 2026-08-09
Google DeepMind 推出了 DiffusionGemma 模型,证明了构建文本扩散模型无需从头开始训练。研究团队通过改造现有的 Gemma 4 模型,仅消耗了不到原始训练预算 10% 的算力成本。
与传统的逐字预测(自回归)不同,该模型采用扩散机制,能够一次性并行生成 256 个 tokens,推理速度飙升至约 1500 tokens/秒。不过,在各项基准测试(尤其是推理任务)中,其整体生成质量目前仍略逊于原始的自回归模型。
「模型」频道最新
- OpenAI 与 Anthropic 周报:Astra 网安评级、GPT-5.6 更新与 Agent 插件 — btibor91 · 2026-08-09
- Meta论文揭示量化导致推理模型过度思考,惩罚特定词可止损 — rohanpaul_ai · 2026-08-09
- 英伟达发布 Nemotron-Parse-2.0,主打文档与图像解析 — nvidia · 2026-08-09
- 曝OpenAI GPT-6本月发布,10T参数预训练,内部称远超Fable — iruletheworldmo · 2026-08-09
- 疑似新 GPT 图像模型曝光,代号 mona-lisa-1 — mark_k · 2026-08-09
- Gemini AI 用户呼吁支持提示词中的代码块渲染 — Novel-Nature-7741 · 2026-08-09