RL 从其他任务泛化,为何文学写作仍是最难的 AI 基准

phl43 · x · 2026-09-22

phl43 认为,即便最新模型在深度概念性问题上仍不完美,表现也远好于文学写作;模型在其他更容易目标上的 RL 训练能带来一定泛化收益,但对文学创作做类似的 RL 既更困难也更昂贵。对话中给出的实操答案是:给模型 rubric、范例并逐步引导,虽能奏效但进展缓慢。

所属事件:文学写作仍是最难 AI 基准,可靠 agent 需评分与引导(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →