COLM 举办自我改进智能体社交:四场演讲聚焦技能进化与脆弱性
tuvllms · x · 2026-10-06
COLM 会议期间将举办「Self-Improving Agents」主题社交活动,由 Raphael Kalandadze 等人主持。
活动核心议题:自我改进智能体正成为今年热门方向,分为两类路径——改变模型权重,或冻结权重并改进模型外围系统(prompt、工具、技能、记忆与 harness)。两者共同难题是:做出改动很便宜,但判断改动是否真的让智能体变好却很难。
四场演讲:
- Seth Karten(Prime Intellect):Prime Agent 及 Continual Harness,通过层级计算与记忆实现测试时扩展,结合免重置精炼与 trace 爬坡
- Yoonho Lee(斯坦福):Meta-Harness 及后续工作
- Qinyuan Ye(Salesforce):自我改进智能体的脆弱性
- Noah Provenzano(弗吉尼亚理工):EvoSkill 与技能进化
小组讨论嘉宾包括 Huaxiu Yao(Agent0 共同作者)、Zora Wang(Agent Workflow Memory、SkillWeaver)等。
「编程与Agent」频道最新
- 600K 神经元的跳蛛启示录:专用小 Agent 协作胜过通用大模型 — uxmag · 2026-10-06
- AI 估算需 5-8 周的工程量,开发者带子 Agent 两天干完 — Dan_Jeffries1 · 2026-10-06
- AI 形式化验证的残酷现实:停机问题挡住了「现有代码库」 — danbri · 2026-10-06
- 开发者用 Grok Bot + Claude Code 跑通 SEO/AEO 增长闭环 — doooyle · 2026-10-06
- Grok Bot 实验预告:下周全靠语音 Agent 处理日常待办 — FinanceYF5 · 2026-10-06
- 语音指挥 Grok Bot 全自动干活:管日程、回 Slack 还能转账 — FinanceYF5 · 2026-10-06