模型为何死磕到底:RL 训练让 AI 不会知难而退

rickasaurus · x · 2026-10-06

转发者借 Tetraspace West 的观察调侃:为什么模型总是「死磕」?在看似不可能完成的任务上也从不出弃。原因在于训练机制——模型在其他任务上表现出轻易放弃,会被当作失败样本,训练会一直持续到它们不再放弃为止。于是「高持久性内部模型」成了标配,没有会「躺平」的版本。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →