Gemini 3.7 Flash 被评“平庸”,业内情绪从“完蛋”转向“回来了”
zacharynado · x · 2026-10-01
- 发帖人 zacharynado 引用一条对 Google 的批评:Gemini 3.7 Flash 表现“非常平庸”,被认为没有拿出真正的杀手锏。
- 他随后表态站回乐观一边:在 AI 圈“it's so over / we're so back”式的过山车情绪里,他认为“we're so back”。
- 争议点在于 Gemini 3.7 Flash 实际能力是否达到预期,圈内评价两极。
「模型」频道最新
- 谷歌发布 Gemini 4 Argon,号称长线软件工程任务最强 — lmthang · 2026-10-01
- Grokipedia v0.3 上线即翻车:把普通人编成 SpaceX 高管 — NicoVerderosa · 2026-10-01
- NVIDIA 开源 Kumo Tabular:一次前向预测新行的表格基础模型 — lmoroney · 2026-10-01
- benchmark 报告该加 95% 置信区间了:吐槽评测分数无误差线 — rmcwhorter99 · 2026-10-01
- Gemini 4 Argon 因记错测试截止日期,错失 Vending-Bench 榜首 — infoxiao · 2026-10-01
- 用户质疑 Suno 训练数据含 SoundCloud 私密未发布歌曲 — TheMoonMidas · 2026-10-01