DeepMind 高级研究员称 Bloomberg 对 Gemini 4 员工差评报道是胡扯
MrZiruiWang · x · 2026-10-02
Bloomberg 报道称 Gemini 4 虽然在常用基准测试上表现不错,但 Google 内部员工实际用起来效果不佳。Google DeepMind 的一位 Senior Staff Research Engineer 公开回应,直指这篇报道是 "bs"(胡扯)。
转发者评论称,任何模型都会有人喜欢有人讨厌,就像任何产品一样没有完美的——哪个模型不曾"在某些编码任务上力不从心"?接受不同观点也许没什么不好。
这一高管级别的否认给 Gemini 4 的发布前景又添了一层悬念:内部实测到底行不行,还要等正式发布来验证。
所属事件:Gemini 4 爆料密集流出:跑分亮眼,彭博曝实战编码拉胯(36 条相关)→
「模型」频道最新
- 为什么 ChatGPT 总爱答 47 和 73? — Princevora03 · 2026-10-02
- 每日简报:Grok 4.7 全面上线,Claude Code 推出 Mods 扩展机制 — testingcatalog · 2026-10-02
- Screen Studio 自训 5000 个假 SwiftUI 应用练出屏幕录制专用超分模型 — CurieuxExplorer · 2026-10-02
- 智能是参差的:够用就好,选最便宜低延迟的模型 — sachdh · 2026-10-02
- 爆料称 Gemini 4 下周起向 Ultra 用户推送,Google TPU 产能或吃紧 — haider1 · 2026-10-02
- 禁用中国模型怎么办?Reddit 求荐 40B 以下替代方案跑代码与长文 QA — AdRepulsive7837 · 2026-10-02