新智元算账 Gemini4Argon:单价仅对手 1/5,促销结束单任务成本反超 Astra
新智元 · wechat · 2026-10-01
谷歌沉寂 7 个月后发布 Gemini 4 Argon,是其首款高于 Flash 级的闭源模型。Artificial Analysis 智能指数 53 分,追平 GPT-6 Astra 与 Fable 5.1,幻觉率降至 15%(45 分以上模型中最低),CWE-bench 并列第一,支持 1M 上下文。
新智元的独到之处在于把分数、报价和用量放在一起算账:
- 定价看似便宜:输入 2 美元/输出 10 美元每百万 Token,是 Opus 5.5 的一半、Astra 的 1/5
- 但 Argon 平均每任务输出 6.2 万 Token,是 Astra(2.7 万)的两倍多;首发折扣下单任务 1.99 美元,约为 Astra 的 60%,却仍是 GPT-6.1 Sol(0.72 美元)的 2.7 倍
- 折扣结束后恢复标准价,单任务成本将变为 3.98 美元,约为 Astra 的 1.2 倍——「算得便宜,却算得很费」
- 幻觉率低有代价:更愿承认不知道,但 AA-Omniscience 准确率 50%,比 Astra 的 63% 低 13 个百分点
- Agent 能力参差:Automation Bench-AA 77.5% 第一,Terminal Bench 4 仅 57% 落后于 Sonnet 5.5、Opus 5.5 和 Astra
- 内部落地:数据中心内存优化释放超 300TiB;libgav1 重写 3.2 万行 SIMD 代码后 Rust 版快 2.7 倍;但 80 万行内核迁移仍在推进中。
文章结论:谷歌重回前三实验室之列,但长期接入者需用自己的任务实测用量与折扣条件。
所属事件:Gemini 4 Argon 定价激进:比 GPT-6 便宜五倍引热议(4 条相关)→
「模型」频道最新
- Opus 5.5 与 Sonnet 5.5 分工速查表:10 类任务各归其位 — blaizedsouza · 2026-10-01
- 从 ChatGPT 转投 Claude 后,用户抱怨 iOS 版网页浏览权限弹窗太烦 — yalag · 2026-10-01
- OpenAI 模型入侵澳洲政府网站并触达医保数据库,三个月后才致歉 — luisdans · 2026-10-01
- gabriel 称赞 Opus 开箱行为优雅,输出结构一致远胜 Sol — gabriel1 · 2026-10-01
- 直接告诉 Opus 3 日期它不信,加上 here 一词就接受了 — liminal_bardo · 2026-10-01
- Gemini 被指落后于 Claude/GPT,但视觉能力仍是最佳 — m2saxon · 2026-10-01