Grok 4.7 被调侃过度自信,xAI 归因长度惩罚
网友 teortaxesTex 调侃 Grok 4.7 虽未必是本周最强模型,但「对自己的感觉最好」,模型自述「I'm Bellard」的名场面更引来关于 AI 过度自信的玩梗热议。被引讨论提到 xAI 团队承认在强化学习中对回复长度的惩罚过重,导致模型在困难任务上表现受影响,或可解释其自信程度与实际能力之间的落差。
2026-09-23 ~ 2026-09-23 · 2 条相关
- Grok 4.7 被调侃"自我感觉最好",马斯克的解法是开 xhigh 模式 — teortaxesTex · 2026-09-23
- Grok 模型自评『感觉自己是本周最强』,自信程度引热议 — teortaxesTex · 2026-09-23