质疑 Gemini 3.7 Flash 排名真实性
scaling01 · x · 2026-08-26
用户对 Gemini 3.7 Flash 在排行榜上的低位表示怀疑,认为这很可疑,并猜测 Google 的奖励模型监控可能存在问题。
「模型」频道最新
- Nvidia 或提供算力支持 GLM 5.3 免费开放 — bindureddy · 2026-08-26
- 微调谬误:模型饱和后成本比质量更重要 — rhythmrg · 2026-08-26
- sanoTTS:140 万参数模型在 $3 芯片上实时运行 — kastnerkyle · 2026-08-26
- 本周新模型盘点:视觉编码器与机器人基础模型 — TheTuringPost · 2026-08-26
- 用户反馈:复杂任务下 Sol Max 比 Sol Ultra 更可靠 — imjustnewatai · 2026-08-26
- 用户反映 GPT 对话标题莫名变成中文,引发猜测 — rodrigoinfloripa · 2026-08-26