Grok 4.7 还要再等几天,Musk 自曝 RL 惩罚回复长度致过早放弃
rohanpaul_ai · x · 2026-09-13
Elon Musk 确认 Grok 4.7 还需几天才能发布。他解释延迟原因:团队可能在 RL 训练中把回复长度惩罚得过重(或类似问题),导致模型面对其实能完成的困难任务时过早放弃,且自我检查的严谨度还不够。发布前需要继续打磨。
所属事件:马斯克称Grok 4.7延期数日,RL惩罚过度致过早放弃(4 条相关)→
「模型」频道最新
- MathAdv 基准:定理证明器解原题却在等价改写上全军覆没 — furongh · 2026-09-13
- 美 AI 圈争论:中国模型进步多大程度靠蒸馏美国前沿模型 — jeremiecharris · 2026-09-13
- 爆料称 Gemini 4 提前完成预训练,归功于训练中的新发现 — inductionheads · 2026-09-13
- 开发者吐槽 Opus 5 产出似图非图内容,质疑 2026 进展明显放缓 — julianharris · 2026-09-13
- Muse Spark 1.3 MAX 上线贡献者档:每月 5 美元,比标准档便宜 20 倍 — acbuller · 2026-09-13
- MoE 路由扩展实测:Qwen3.6-35B 扩展后 GPQA 达 84.34% — Specific-Tax-6700 · 2026-09-13