彭博:Gemini 4 跑分亮眼,谷歌内部员工却称实际干活拉胯
Neurogence · reddit · 2026-10-01
彭博报道,尽管 Gemini 4 在行业基准测试上表现出色,但据直接接触该模型的内部人士透露,谷歌员工在真实使用中对其持怀疑态度:模型在部分编码任务上表现挣扎。受访者因讨论内部事务要求匿名。发帖人补充认为,等它正式面向消费者发布时,Anthropic 和 OpenAI 的下一代模型可能已经先行上市。
所属事件:彭博:Gemini 4 跑分亮眼,内部实测编码却遇冷(4 条相关)→
「模型」频道最新
- 爆料称谷歌 Gemini 4 Argon 已悄然上线,速度远超预期 — Dr_Singularity · 2026-10-01
- 3.6B 本地模型 TwIL-LM3-Pro 形式逻辑碾压 VibeThinker-3B 达 35% — rohanpaul_ai · 2026-10-01
- 实测:Sol 6.1 推理速度比 Opus 慢近 6 倍,但 token 效率更高 — RexDouglass · 2026-10-01
- AA 智能指数被质疑:Sonnet 5.5 竟高于 fable 5.1 — Ill_Distribution8517 · 2026-10-01
- 用户用 Opus 5.5 联合执导东京短片,成果亮相 — ebbyamir · 2026-10-01
- 研究者吐槽:别用'永远迷糊'的聊天机器人处理核危机 — examachine · 2026-10-01