研究者携「推理模型潜空间策略状态」解读工作参加 COLM
hunarbatra · x · 2026-10-06
- 作者 hunarbatra 宣布将在本周的 COLM 会议上展示关于推理模型中潜空间策略状态(Latent Policy States)的研究。
- 研究方向涉及可操作的模型可解释性、AI control、reward hacking、meta models、安全后训练与评测。作者欢迎与会者交流相关话题。
「研究」频道最新
- COLM 论文 SLIM:面向长程任务的智能体搜索框架 — xiye_nlp · 2026-10-06
- 光遗传学诺奖之争:被遗忘的真正发明人潘卓华 — _onionesque · 2026-10-06
- COLM 2026 现场多位博士生亮相求职,方向覆盖合成监督与人类评估 — tongshuangwu · 2026-10-06
- Kyutai 用何恺明团队 Drifting 方法训练 100M 端侧 TTS,WER 低于 1% — serrjoa · 2026-10-06
- 谷歌SHIFT按查询自动构建多智能体系统,准确率领先最强基线7.2点 — google · 2026-10-06
- 新研究诊断LLM数学短板:发现能力是最大瓶颈,可定向修复 — TexasAMUniversity · 2026-10-06