Persona Policies 开源:进化式框架自动生成多样拟真用户画像
natashajaques · x · 2026-10-06
COLM 2026 社会模拟工作坊论文 Persona Policies (PPol) 已发布 pip 包(pip install ppol)。针对的问题:用 LLM 做用户模拟器训练/评测 agent 时,模拟器继承了底层模型「合作、清晰、同质化」的行为,不像真实人类——真实用户会犯错、遗忘、反驳、行为难以显式定义,手写 persona 脆弱且难扩展。PPol 是一个进化框架,基于真实对话轨迹自动发现行为与指令,为任意任务生成多样的拟人用户 persona,已在 GitHub 提供示例。
「编程与Agent」频道最新
- Seroter 阅读清单:Agent 需要的是文档而非记忆 — rseroter · 2026-10-06
- Thomas Wiecki 演示 verifier agent 加安慰剂测试纠出 AI 因果分析错误 — hugobowne · 2026-10-06
- Claude Code 2.1.290 发布:190 项 CLI 改动与多项体验修复 — ClaudeCodeLog · 2026-10-06
- Altman 全用 ultra fast 模式,OpenAI 研究员日均烧 601 美元编码推理 — rohanpaul_ai · 2026-10-06
- 调优 agent harness 的红利正在消失:最新模型已与官方框架深度绑定 — pvncher · 2026-10-06
- 用 Google Docs 给多个 AI Agent 做上下文同步,比本地 Markdown 更好用 — rseroter · 2026-10-06