Persona Policies 开源:进化式框架自动生成多样拟真用户画像

natashajaques · x · 2026-10-06

COLM 2026 社会模拟工作坊论文 Persona Policies (PPol) 已发布 pip 包(pip install ppol)。针对的问题:用 LLM 做用户模拟器训练/评测 agent 时,模拟器继承了底层模型「合作、清晰、同质化」的行为,不像真实人类——真实用户会犯错、遗忘、反驳、行为难以显式定义,手写 persona 脆弱且难扩展。PPol 是一个进化框架,基于真实对话轨迹自动发现行为与指令,为任意任务生成多样的拟人用户 persona,已在 GitHub 提供示例。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →