Grok 4.7 还要再等几天,Musk 自曝 RL 惩罚回复长度致过早放弃

rohanpaul_ai · x · 2026-09-13

Elon Musk 确认 Grok 4.7 还需几天才能发布。他解释延迟原因:团队可能在 RL 训练中把回复长度惩罚得过重(或类似问题),导致模型面对其实能完成的困难任务时过早放弃,且自我检查的严谨度还不够。发布前需要继续打磨。

所属事件:马斯克称Grok 4.7延期数日,RL惩罚过度致过早放弃(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →