本周新模型盘点:视觉编码器与机器人基础模型
TheTuringPost · x · 2026-08-26
本周值得关注的新模型包括:
- MoE-ViE:Meta 发布的稀疏混合专家视觉编码器,用于高效的图像和视频理解。
- τ0-VLA:机器人基础模型,在行动前“思考”可能的结果。
- 4DAnyone:蚂蚁集团与浙江大学合作,将单个休闲视频转化为可动画的 4D 人体。
- WithEveryone:腾讯混元发布的图像模型,可在生成群像场景时保持每个人的身份。
- PixRestore:OPPO 研究院与理大合作,直接在像素空间修复图像的紧凑扩散 Transformer。
所属事件:本周新模型盘点:Meta 视觉编码器与机器人基座模型(2 条相关)→
「模型」频道最新
- 传 OpenAI 下代模型 Astra 攻克难题,因高风险被暂 — haider1 · 2026-08-26
- 正式宣布:视频模型进入「后训练时代」 — gorkem · 2026-08-26
- Accelerated Understanding 推出基于神经算子架构的新 AI 模型 — badumtsssst · 2026-08-26
- Nvidia 或提供算力支持 GLM 5.3 免费开放 — bindureddy · 2026-08-26
- 微调谬误:模型饱和后成本比质量更重要 — rhythmrg · 2026-08-26
- sanoTTS:140 万参数模型在 $3 芯片上实时运行 — kastnerkyle · 2026-08-26