Grok 4.7 被调侃过度自信,xAI 归因长度惩罚

网友 teortaxesTex 调侃 Grok 4.7 虽未必是本周最强模型,但「对自己的感觉最好」,模型自述「I'm Bellard」的名场面更引来关于 AI 过度自信的玩梗热议。被引讨论提到 xAI 团队承认在强化学习中对回复长度的惩罚过重,导致模型在困难任务上表现受影响,或可解释其自信程度与实际能力之间的落差。

2026-09-23 ~ 2026-09-23 · 2 条相关