谷歌连夜发 Gemini 4 Argon:百万输出 Token,员工却曝实战拉胯

APPSO · wechat · 2026-10-01

谷歌 DeepMind 发布新模型 Gemini 4 Argon,通过「Fairwind 计划」先向网络安全防御者小范围开放,并参与美国政府发布前准入流程,后续才面向付费 API 客户与 AI Ultra 订阅用户。核心升级是输出窗口从 6.4 万 Token 提升至 100 万 Token,首发定价输入 2 美元/百万 Token、输出 10 美元,缓存命中输入端约 95% off。

官方战报:DeepSWE v1.1 软件工程基准 77.9% 新纪录,Vals Index 金融/编程/法律/税务全面领跑,LVBench 长视频理解 91.7%;与 Wiz 合作在医疗软件中挖出高危漏洞,CWE-bench v1 得分 68% 并列第一。内部案例包括自动释放数据中心 300TiB 以上内存、将 C/C++ 代码库迁移至 Rust(libgav1 替换 3.2 万行 SIMD 代码,比现有 Rust 移植版快 2.7 倍)。

但彭博社爆料称多位知情人士透露 Argon「高分低能」,实战写代码尤其前端设计拉胯,业内称这种现象为 Benchmaxxing;部分员工私下认为 Anthropic 与 OpenAI 进步更快,也有核心员工与谷歌发言人否认相关说法。文章还梳理了谷歌的人才流失(Jeff Dean、Noam Shazeer 离职、Demis Hassabis 转任董事长)与战略摇摆,以及面对 Personal Agent 类产品冲击搜索分发优势的隐忧。

所属事件:Google 官宣前沿模型 Gemini 4 Argon(59 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →