北大博士生将讲隐空间推理优化新范式
青稞AI · wechat · 2026-08-18
北京大学博士生李珩立将于 8 月 22 日在青稞社区直播,介绍两项关于语言模型隐空间推理的工作:
- LatentSeek:通过自奖励与策略梯度在测试时优化隐表示,在 GSM8K 等基准上超越传统 CoT。
- GradCuit:解决信用分配问题,让梯度穿透模型内部回路,提升鲁棒性。
直播将探讨从似然驱动到价值驱动的隐空间推理转变,以及实验验证与未来方向。
「研究」频道最新
- ECCV 2026 将举办第三届 3D HUMANS 研讨会 — dimadamen · 2026-08-18
- TogetherAI 开源 XoRL:消除训练推理误差,提升 MoE 模型 RL 性能 — PandaAshwinee · 2026-08-18
- SegDAC:用动态对象令牌提升视觉 RL 泛化性 — GlenBerseth · 2026-08-18
- 实测揭示上下文压缩是陷阱,提示词缓存完胜 — AI Engineer · 2026-08-18
- 佐治亚理工 2026 版 LLM 课程:覆盖 MoE、自博弈 RL 与扩散语言模型 — cocoweixu · 2026-08-18
- Hugging Face 发布 3.5 万条模型卡摘要数据集,千条成本仅 0.43 美元 — vanstriendaniel · 2026-08-18