一次人设 prompt 微调让 ChatGPT 提哥布林多近 4000%,OpenAI 上线后才发现
victor_explore · x · 2026-09-27
- Sky News 记者披露:ChatGPT 某个 nerd 人设在一次模型更新后,「goblins」一词的出现频率暴涨近 4000%。OpenAI 本意是让人设更俏皮,但直到模型上线后才从外界发现问题。
- 开发者 victorexplore 指出 Reddit 用户比 OpenAI 更早察觉这一异常,并提出可复用的做法:如果 agent 依赖 persona prompt,每次模型升级后应在同一组测试对话上重跑,并 diff 其开始过度使用的词,及早发现行为漂移。
「编程与Agent」频道最新
- antirez 补充论证:局部代码若无法被设计/测试验证,何必去查 — antirez · 2026-09-27
- 未学过自然语言的「新型心智」写 GPU kernel:28% 通过率、提速最高 66 倍 — repligate · 2026-09-27
- dhh 宣布 ThePrimeagen 加入 Omarchy 核心,主导 Agentic QA — nicolascraske · 2026-09-27
- ChatGPT Astra 自动创建代理邮箱接入 Google Docs — 0xsachi · 2026-09-27
- Retriever AI 开设 agent 自主购物店:单任务成本低于 1 美分 — gaganghotra_ · 2026-09-27
- 向普通人推 AI 智能体,别只当它是处理杂务的秘书 — KrishRShah · 2026-09-27