谷歌发布三款 Gemini 新模型并宣布 Gemini 4 预训练

谷歌正式发布了 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 以及 Gemini 3.5 Flash Cyber 三款新模型,并已在 Google AI Studio、Vertex API 和 Gemini App 等平台上线。此次更新基于开发者对上一代模型的反馈,旨在提供更适合真实场景的大规模智能体应用,核心主打更强智能、更省 token 和更低价格。此外,官方透露 Gemini 4 已进入预训练阶段,马斯克也发帖回应了此次发布。

关键细节与特性

Gemini 3.6 Flash 被官方定位为目前最强模型之一,主打在相同成本下用更少的 token 输出更高质量的结果。相比 3.5 Flash,新模型不仅定价更低(输入每百万 token 1.50 美元、输出每百万 token 7 美元),在完成复杂工作流时输出 token 最多减少 17%,同时减少了不必要的推理步骤和工具调用。它在写生产级代码、图表分析和文档理解等多模态任务上也有提升,并能快速提取照片材质构建创意工具。另一款 3.5 Flash-Lite 则是目前最小、最快的模型之一,输出速度接近每秒 350 token,其价格与即将退役的 2.5 Flash 相同。此外,谷歌还推出了对标 Anthropic Mythos 的 3.5 Flash Cyber 模型,主攻网络安全方向,目前限量供政府和可信伙伴使用。

评测与各方反应

在基准测试方面,多位开发者的对比图显示 Gemini 3.6 Flash 在多项智能体评测中表现强势,@bindureddy 甚至将其称为“世界上最好的聊天模型”。然而外部评价存在严重分歧:@bindureddy 指出该模型在某些基准跑分中低于上一代 3.5 Flash,且比 Grok 和 Luna 更贵;@truecakesnake 根据 Artificial Analysis 数据称其跑分与 3.5 Flash 基本持平;@XFreeze 也对比指出其同任务成本竟高于 Grok 4.5。这些争议表明,新模型在实际应用中的性价比可能并未完全达到官方宣传的预期。

下一代模型动态

在密集发布新一代模型的同时,谷歌 Logan Kilpatrick 等人透露,Gemini 4 已经进入“迄今最雄心勃勃”的预训练阶段。据 @kimmonismus 转述,Gemini 4 将是一个完全新的基础模型,目前进展令人振奋。

2026-07-21 ~ 2026-07-23 · 156 条相关

事件全程(共 4 集)→

另有 6 条近重复转述:Acceptable-Debt-294 · BLCNYY · OwariDa · Keano5567 · osanseviero · rseroter