280B MoE 模型 dots3-note 发布:RL 学习记忆
Aiden_Tech_Ai · x · 2026-08-17
dots3-note 预览版发布,这是一个迈向现实长周期智能体的新模型。其核心特点是引入了 TEMPO,一种通过自我批判和时间缩放价值估计来进行长周期训练的新强化学习方法。该模型能自主学习记忆内容,甚至记录自身错误而非静默覆盖。
关键参数:
- 280B MoE 架构,16B 激活参数
- 512K 上下文窗口
- 多模态(文本、视觉、音频)理解能力
该模型已在 Hugging Face 开源权重,并发布了两个现实智能体基准:VibeSearchBench 和 VibeLifeBench。
「模型」频道最新
- 被 Claude 编码能力忽悠? 代码多是复制粘贴 — art_zucker · 2026-08-17
- 实测Fable代码能力:胜过Opus 5的优雅解法 — arjunrajlab · 2026-08-17
- Claude 文本水印采用 SynthID:逐 token 写入,改写即可破 — APPSO · 2026-08-17
- 预览 dots3-note:280B 参数开源多模态模型,支持长上下文 — Aiden_Tech_Ai · 2026-08-17
- 为何 Qwen 3.8 27b 并非过度思考?实测对比 GLM 与 DeepSeek — sukazu · 2026-08-17
- Meta Muse Glimmer 30B 惊人架构:原生支持 512k 上下文 — mr_il · 2026-08-17