Gemini 4 Argon 跑分亮眼,老问题仍在:谷歌模型实战总显平庸?
VraserX · x · 2026-10-01
科技评论者 VraserX 吐槽谷歌模型的老毛病:benchmarks 上看起来极其惊艳,实际使用中却总感觉平庸。他称 Gemini 4 Argon 在纸面上非常出色,并希望这一代谷歌能最终证明他的怀疑是错的。帖子引发对「跑分与真实体验落差」的讨论。
「模型」频道最新
- 谷歌 Gemini 4 发布,参与者在科学推理上贡献获曝光 — shagunsodhani · 2026-10-01
- 用户观察:Claude Opus 5.5 会跨项目串上下文 — repligate · 2026-10-01
- AI 时代的「太阳灯卡特尔」:厂商可静默调低你的模型 — maier_ak · 2026-10-01
- Codex 电脑使用功能存 bug:dot 任务缺失 node_repl 运行时 — ChrisGPT · 2026-10-01
- Reddit 用户求助:MiniMax H3 图生视频 prompt 不好写 — koko008_image · 2026-10-01
- AI 进度加速:智能指数冲榜间隔从 239 天缩至 99 天 — ArtificialAnlys · 2026-10-01