一个群聊人格 Agent 会从纠错和反应里自我学习

Xiaole-Dawn · reddit · 2026-07-25

一个会从回复反馈中持续学习的人设群聊 Agent

作者受够了人设 bot 用着用着又退化成“客服口吻”:再怎么调 prompt,聊几轮后还是会变得过于礼貌、爱追问、什么都想兜底。

他的思路不是重新微调模型,而是让 agent 学习“回复之后发生了什么”——

难点在于怎么判断反馈是否可信。作者因此加了一个仲裁层,会看定向反应、反馈来自谁,以及纠正是否合理,再决定是否写入记忆。

这个系统不做微调,而是存例子和偏好对,再在后续对话里以 few-shot 形式检索出来立即生效。

项目还附了一个终端演示,不用先接 QQ/Discord 之类的群聊平台也能试整套流程。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →