彭博称谷歌员工担忧Gemini 4编码能力,内部人士反驳:反响最佳
xennygrimmato_ · x · 2026-10-02
据 Bloomberg 报道,Google 正准备发布 Gemini 4,但部分有内测权限的员工称其跑分表现未转化为实际体验,主要问题在编码与前端设计任务,且模型体积庞大、运行成本可能更高;Google 否认该说法,称内部广泛共识认为模型处于前沿水平,并已放弃原计划重启的 Gemini 3.5 Pro。谷歌内部人士 SicongJiang25 强硬反驳称彭博报道「脱离现实」,称 Gemini 是内部反响最好的 Gemini 模型,对「内部普遍担忧」的说法感到困惑。
所属事件:Gemini 4 爆料密集流出:跑分亮眼,彭博曝实战编码拉胯(36 条相关)→
「模型」频道最新
- 第三方评测:Cloudflare clef 编码强但太贵,综合不及 Jev — airesearch12 · 2026-10-02
- GPT-6 Astra 实测:写作惊艳但产品直觉仍输 Fable — every · 2026-10-02
- MIT 科技评论发文:别被 fooled——LLM 其实不会推理 — leopoldj · 2026-10-02
- JevBench 更新至 v1.5.5:能力榜前十不变,Jev 仅列综合第三 — airesearch12 · 2026-10-02
- Anthropic 发布研究:Claude 正在重塑科学研究的形态 — famouswaffles · 2026-10-02
- 24GB 显卡塞下 Qwen3.8-27B 编码模型:262k 上下文仍有 40 t/s — W61k3r · 2026-10-02