新“想象模型”称靠 18 年视频学会电脑操作
joemeno · x · 2026-07-25
引用内容是在介绍一种新的 foundation model 架构:“imagination models”。它的首个模型 Photon-1 被称为可以通过超大规模视频数据学习,并且在没有动作标注的情况下,仅靠 18 年的屏幕录制视频学会使用电脑。
- 重点是新的架构思路,而不是单一产品。
- 结果指向的是从互联网规模视频中学习通用行为能力。
- 这类内容更接近研究突破,也带有明显的视频/多模态味道。
所属事件:Photon-1 模型靠 18 年无标签视频学操作电脑(4 条相关)→
「研究」频道最新
- 3D ResNet 论文八年突破 3000 引用,Kinetics 数据集成里程碑 — HirokatuKataoka · 2026-09-11
- 把数据调度变成优化的一部分:样本选择与排序影响 LLM 训练 — Puzzleheaded_Box2842 · 2026-09-11
- Jeff Heaton《神经网络数学导论》开放免费完整下载 — blaizedsouza · 2026-09-11
- 数学家 Daniel Litt 上线问题库,15 题仅 1 题被解,用来追踪 AI 解题进度 — littmath · 2026-09-11
- AI 智能体协作优化 secp256k1 量子电路,挑战打破 ECDSA — StefanoGogioso · 2026-09-11
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11