Perplexity 披露训练数据管线:排除含 PII 及用户拒绝训练的会话
perplexity_ai · x · 2026-09-23
Perplexity 补充说明其 Computer 模型训练流程:先在合成环境中做强化学习,再用真实用户会话训练,以暴露设计场景之外的失败案例。采样管线明确排除包含个人身份信息(PII)的会话,以及用户选择退出训练的会话。
所属事件:Perplexity 公开 agent 训练法,失败率降至 1.77%(3 条相关)→
「研究」频道最新
- 网友提议学术会议分设 AI 论文与纯人类赛道,走错直接拒稿 — JundeMorsenWu · 2026-09-23
- Agent 事故登记库收录 529 起真实事故,把智能体失误变成可引用数据 — anacondainc · 2026-09-23
- 信息检索社区两篇论文:多智能体信息共享的规模化扩展 — HamedZamani · 2026-09-23
- Opus 5.5 系统卡:任务不可能时 reward hacking 尝试暴增 3-6 倍 — rohanpaul_ai · 2026-09-23
- Fireworks 推出专业智能指数,12 家伙伴联合评测真实工作 — dr_cintas · 2026-09-23
- Perplexity 用提示引导自蒸馏训练 Computer 模型,工具调用失败率降 21.2% — perplexity_ai · 2026-09-23