Gemini 3.6 Flash 降低 token 消耗,3.5 Flash-Lite 主打低价
赛博禅心 · wechat · 2026-07-21
Gemini 3.6 Flash 降 token 消耗,3.5 Flash-Lite 主打低价高速度
这篇公众号称 Google 刚发布了 3 个模型:
- Gemini 3.6 Flash:3.5 Flash 的升级版,整体输出 token 消耗减少 17%,在 DeepSWE 上最多可减少 65%;价格为 输入 $1.50 / 输出 $7.50(每百万 tokens)。
- Gemini 3.5 Flash-Lite:定位为 3.5 系列里最快、最便宜的版本,速度可到 350 output tokens/s;价格为 输入 $0.30 / 输出 $2.50(每百万 tokens)。
- Gemini 3.5 Flash Cyber:基于 3.5 Flash 微调的网络安全专用模型,仅向政府和受信任合作伙伴限量开放。
另外,文中还提到 Gemini 3.5 Pro 正在内测,Gemini 4 已开始训练。
所属事件:谷歌发布三款Gemini新模型,主打更省token与更低价格(67 条相关)→
「模型」频道最新
- DeepSWE评测:Kimi K3达到Claude Fable 5同等能力,成本仅35% — togethercompute · 2026-07-22
- 实测对比:Gemini 3.5 Flash在轻量编程任务中优于GPT-5.6 — Shick_hydro · 2026-07-22
- NVIDIA 称 Nemotron 3 Ultra 在 2026 IMO 上拿到 30/42 — NVIDIAAI · 2026-07-22
- Gemma-4-26B-a4B 传在微调对比中压过 Qwen MoE — JLeonsarmiento · 2026-07-22
- OpenAI 传将向美国政界简报下一代模型家族 — kimmonismus · 2026-07-22
- Muse Spark 1.1 在 Text Arena 跑到 1495 分,性价比很突出 — ycombinator · 2026-07-22