Perplexity 用提示引导自蒸馏训练 Computer 模型,工具调用失败率降 21.2%
perplexity_ai · x · 2026-09-23
Perplexity 发布新研究:对其 Computer 模型做后训练,采用「提示引导自蒸馏」(hint-guided self-distillation)方法让模型从自身错误中学习。在线 A/B 测试显示,较晚训练的 checkpoint 相比早期 checkpoint 将工具调用失败率相对降低了 21.2%。
所属事件:Perplexity 公开 agent 训练法,失败率降至 1.77%(3 条相关)→
「编程与Agent」频道最新
- DigitalOcean 推云端托管 Agent:闲置即暂停,断电续跑会话 — _AustinCalvert_ · 2026-09-23
- 让听众学会打断:CMU×Meta 方法砍掉多智能体 32.2% 通信成本 — lileics · 2026-09-23
- 作者实测:本地免费跑 Opus 级编码 agent,速度近两倍 — julianharris · 2026-09-23
- 编码 Agent 用 as any 修 TS 报错?可能在悄悄消灭编译反馈 — gethackteam · 2026-09-23
- 别再审计划了:让模型一次交 3 个端到端方案 — alex_frantic · 2026-09-23
- 洗个澡的功夫:一条语音让 AI 代理从零做出 JEV 原型 — NathanWilbanks_ · 2026-09-23