本周必读 AI 论文:智能体、长上下文 RL 和机器人策略

TheTuringPost · x · 2026-07-21

### 本周值得读的 AI 论文 这是一则本周论文速览,覆盖 agent harness、长上下文强化学习、机器人策略、视觉推理以及 agent 自我改进等多个方向。 重点包括: - **Harness Handbook**:提出一种面向行为的 agent harness 表示,并结合 **Behavior-Guided Progressive Disclosure (BGPD)**,帮助编程 agent 定位并修改真正相关的代码路径。 - **LongStraw**:在固定 GPU 预算下,把长上下文强化学习推进到 **200 万 token** 以上。 - **SEED**:面向 agentic reinforcement learning 的自演化 on-policy 蒸馏。 - **RoboTTT**:讨论机器人策略的上下文扩展。 - **UniVR**:在视觉空间中做统一视觉推理。 - **Partition, Prompt, Aggregate**:研究语言模型中的统计自一致性。 - **Tracing Agentic Failure from the Flow of Success**、**Self-Improvements in Modern Agentic Systems**:分别分析 agent 的失败模式和自我改进机制。 整体是一篇带链接的 AI 论文/资讯汇总,适合快速把握本周研究动向。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →