为何文学 RL 难做:没有 ground truth,谁来给小说打分?

teortaxesTex · x · 2026-09-22

teortaxesTex 回应「AI 为何写不好文学」的讨论:确实有人做过针对性尝试,但并非优先级,而且这活儿真的难——因为缺乏 ground truth。「在线打分怎么打?靠语言模型当裁判吗?」他对比:编程有测试、计算可即时验证、Lean 让数学可验证,而文学创作缺少这样的可验证性,这正是 RL 难以在该领域发力的核心原因。

所属事件:AI 为何写不好严肃文学:品味方差与艺术意图之辩(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →