过度 RL 让模型变得字面化?CoT「粗人语」损害推理连贯性

mike64_t · x · 2026-09-09

作者对比认为代号 Fable 的模型在推理中更能召回软性信息、做出 OpenAI 模型几乎不会的「软跳跃」,而 OpenAI 模型令人痛苦的过度字面化,根源可能在于过度 RL 加上 CoT 的「粗人语」(caveman speak)压缩了推理的表达空间,连系统提示都要专门写「仅承认能帮忙是不够的」。

观点要点:

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →