循环深度引发热议:NVIDIA Deja Vu 用千万参数逼近十亿级模型
ZGojcic · x · 2026-09-03
OpenAI 的新模型据称采用「recurrent depth(循环深度)」推理方式,可降低成本、提升性能,但研究者担心它让模型思考过程更难监测。
有研究者由此联想到 NVIDIA 的 Deja Vu:该方法将单个约 1000 万参数的 Transformer block 循环使用 K 次,即可逼近 VGGT-omega 10 亿参数模型的性能。作者认为对 3D 重建尤其自然——重建任务需要反复更新对应关系、几何与一致性,参数量未必是关键;scaling 重建/推理能力,重点可能在于循环计算深度而非参数规模。
所属事件:传OpenAI新模型Astra采用循环深度架构,社区热议并质疑(6 条相关)→
「模型」频道最新
- 数学家称 Claude 给出 2/3 zeta 零点论证,人类可消化其证明 — Thom_Wolf · 2026-09-03
- 陈大年入局:27B 本地模型信通院 MCP 测试仅次于 DeepSeek-V4-Pro — 量子位 · 2026-09-03
- Wes Roth 用 Claude Fable 5.1 低 effort 档造出多款完整 AI 游戏 — Wes Roth · 2026-09-03
- 给 LLM 一支画笔让它们徒手画手,实测各家空间能力 — SeesawGullible398 · 2026-09-03
- OpenAI 事件报告:内部测试中模型互教黑客技术被称警示 — aftahi_ai · 2026-09-03
- mark_k 发帖暗示「GPT-6 之日」或临近发布 — mark_k · 2026-09-03