4D 训练上下文达 1T,视频生成与 3D 场景算力对比引热议
srchvrs · x · 2026-08-26
针对上下文窗口规模的讨论,引用了关于“直接 4D 训练”达到 1T 上下文、推理超过 5T 的惊人数据,并对比了不同模态的原始像素/网格点算力需求:
- 视频生成(Veo 3.1, Kling 3.0 等):8-15秒 1080p-4K 片段约 10 亿像素/点,一次性生成但无显式 3D。
- Marble:静态 3D,由约 10^7 像素全景图提升至约同等数量的持久场景点。
- Genie 3:交互式 720p@24fps,随移动逐帧生成,1 分钟内存约 13 亿像素。
「研究」频道最新
- 通过版本对比追踪并发现 scikit-learn 的 Bug — Lost-Dragonfruit-663 · 2026-08-26
- Gemini Flash 3.7 联手 GraphJin,实测通过企业级 Agent 安全基准 — dosco · 2026-08-26
- 机器人研究员反思:先问推理行为,再谈模型训练 — deepakpathak · 2026-08-26
- AI 训练应诚实告知模型环境是假的 — Sauers_ · 2026-08-26
- 研究发现LLM推理易受“先验劫持”误导 — RexDouglass · 2026-08-26
- 上交大 SemaPLC:验证闭环让 AI 写 PLC 代码动态行为得分翻 1.7 倍 — 量子位 · 2026-08-26