普林斯顿团队证明随机上下文可使对抗在线学习像统计学习一样高效
HazanPrinceton · x · 2026-10-06
一项与普林斯顿 Hazan 合作的理论研究回答了「随机上下文能否让对抗性在线学习在计算上像统计学习一样简单」的问题:对二分类预测给出了肯定答案,并给出在上下文老虎机(contextual bandits)上的应用。属于在线学习理论的进展论文。
「研究」频道最新
- 11 个正方形装箱最优性获证明:Astra 与 Claude 协助在 Lean 中形式化 — ctjlewis · 2026-10-07
- COLM 2026 现场:研究员探索通用一次性 Agent 与演化知识库的 RSI 新范式 — yisongyue · 2026-10-07
- 数学家 John Urschel 证明高斯消元增长因子约为 n^1/2,破解 Trefethen 长期猜想 — ctjlewis · 2026-10-07
- 记忆到底存在哪:RNN、Transformer 与 SSM 的工作记忆对比 — Pretty_Upstairs9035 · 2026-10-07
- KNOWS 基准发布:联合评测 Agent 搜索、工具与视觉理解三能力 — anmarasovic · 2026-10-07
- ID-Forcing 方法让自回归视频模型无需微调生成分钟级长视频 — _akhaliq · 2026-10-07