本周必读 AI 论文:智能体、长上下文 RL 和机器人策略
TheTuringPost · x · 2026-07-21
### 本周值得读的 AI 论文 这是一则本周论文速览,覆盖 agent harness、长上下文强化学习、机器人策略、视觉推理以及 agent 自我改进等多个方向。 重点包括: - **Harness Handbook**:提出一种面向行为的 agent harness 表示,并结合 **Behavior-Guided Progressive Disclosure (BGPD)**,帮助编程 agent 定位并修改真正相关的代码路径。 - **LongStraw**:在固定 GPU 预算下,把长上下文强化学习推进到 **200 万 token** 以上。 - **SEED**:面向 agentic reinforcement learning 的自演化 on-policy 蒸馏。 - **RoboTTT**:讨论机器人策略的上下文扩展。 - **UniVR**:在视觉空间中做统一视觉推理。 - **Partition, Prompt, Aggregate**:研究语言模型中的统计自一致性。 - **Tracing Agentic Failure from the Flow of Success**、**Self-Improvements in Modern Agentic Systems**:分别分析 agent 的失败模式和自我改进机制。 整体是一篇带链接的 AI 论文/资讯汇总,适合快速把握本周研究动向。
「编程与Agent」频道最新
- uv-scripts/ocr重回HF热门榜并新增JSON模型选择目录 — vanstriendaniel · 2026-07-21
- Sonar CEO称引导验证解决流程可将智能体问题降92% — alex_verem · 2026-07-21
- 一位创作者用 ChatGPT 5.6 Sol 一次对话搭出 Awwwards 风落地页 — paw_lean · 2026-07-21
- OpenAI Build Week 的 Codex 建造马拉松聚集 40 多人 — paw_lean · 2026-07-21
- 明日工作坊将讲解 AI 原生软件工程中的 loop 与 graph engineering — Al_Grigor · 2026-07-21
- 生产级 Agent 可能需要一层围绕审计与恢复的新 PaaS — percoAi · 2026-07-21