← 返回全球模型雷达

美国 · Google DeepMind

Google Gemini / Gemma 模型历史

Google 现在最值得看的不是单个“最强”型号,而是 Gemini 3.5 Flash、即将公开的 3.5 Pro、Gemini Omni 与 Antigravity 2.0 一起把默认模型层、视频创作层、编码 Agent 层和生态入口重新排了一次序。

Gemini 3.5 FlashGemini 3.5 ProGemini Omni / Omni FlashAntigravity 2.0 / Managed AgentsGemini Spark / Daily BriefSearch AI Mode agentsGoogle AI Ultra 100 / 200API pricing update

当前重点模型

Gemini 3.5 Flash

当前 Google 最值得看的默认主力候选,更适合做大流量入口而不是只做展示“最强”的模型。

官方/参考来源 →
最新 · 2026-05

Gemini 3.5 Flash

当前 Google 最值得看的默认主力候选,更适合做大流量入口而不是只做展示“最强”的模型。

推理代码中文多模态上下文速度成本友好
推理90
代码88
中文82
多模态95
上下文95
速度94
成本友好84

类型:闭源API

上下文:GA via Gemini app / Search / Antigravity / Gemini API; public API pricing page still catching up

输入:Public standalone 3.5 Flash API pricing not yet listed

输出:Validate with current Google pricing page before budgeting

更适合做默认高频流量层、搜索增强问答层和轻量编码。如果你原来用 2.5 Flash 承压大部分基础请求,现在值得重新做一轮真实路由测试。

观察 · 2026-05

Gemini 3.5 Pro

更像 Google 高价值判断层,适合把复杂任务和关键输出留在这里。

推理代码中文多模态上下文速度成本友好
推理95
代码91
中文83
多模态96
上下文96
速度82
成本友好58

类型:闭源API

上下文:Google says it is already in internal use and plans a public rollout next month

输入:Not publicly listed yet

输出:Not publicly listed yet

更适合复杂推理、重要文档、高价值代码和你不想轻易返工的最终判断层。大部分团队不应该让它承接全量默认流量。

观察 · 2025-2026

Gemini 2.5 Flash

仍可以短期留在灰度层,但最值得做的是用它和 3 Flash 跑真实路由对比。

推理代码中文多模态上下文速度成本友好
推理86
代码84
中文80
多模态92
上下文94
速度88
成本友好90

类型:闭源API

上下文:1M context / preview route

输入:$0.30 / 1M tokens

输出:$2.50 / 1M tokens

更适合做过渡和对比基准。如果你的流量路由是基于 2.5 Flash 搭建的,现在最该做的不是继续固守,而是重新测试 3 Flash 是不是已经能接住默认层。

历史 · 2026-04-02

Gemma 4

适合开发者和低成本垂直应用,但不是今天最值得普通用户先看的默认入口。

推理代码中文多模态上下文速度成本友好
推理82
代码82
中文76
多模态78
上下文76
速度86
成本友好88

类型:开放权重

上下文:按模型尺寸不同

输入:本地/托管成本

输出:本地/托管成本

Gemma 4 更适合开发者和本地部署路线。它代表的是 Google 开放模型方向,而不是 Gemini App 的默认主力入口。