Gemini 模型谱系
Gemini 以原生多模态和超长上下文为主线,逐步向推理、代码、实时交互与托管 Agent 扩展。
历代模型
Gemini Robotics 2
VLA 模型 + ER 2 具身推理 + On-Device 2 端侧模型,在 Apptronik Apollo 2 人形机器人上演示,并发布 ASIMOV-Agentic 安全基准。
Gemini 3.7 Flash
距 3.6 Flash 仅三周:编程与智能体场景主力模型,DeepSWE 49.0%→65.3%、WebDev Arena Elo 1588;限时五折定价至年底,接入 Gemini Spark 与 Enterprise Agent Platform。
Gemini 3.6 Flash
工作马级 Flash 更新,输出价下调、1M 上下文,与 Flash-Lite、Flash Cyber 同日发布;旗舰 3.5 Pro 继续缺席。
Gemini 3.5 Flash
Google 当前面向持续高强度 Agent 与代码任务的最智能 Flash 模型,并成为 gemini-flash-latest 的默认指向。
Veo 3
原生同步音频与更强可控性,接入 Gemini 应用与 API。
Veo
Google DeepMind 视频生成旗舰亮相 I/O,对位 Sora 后的全球视频赛道。
Gemini 3.1
更新 Pro、Flash-Lite 与视觉生成分支,在性能、成本和媒体能力之间形成更细的产品层级。
Gemini 3
继续整合多模态、工具与 Agent 能力,并扩展图像、语音与计算机操作分支。
Gemini 2.5
把可控思考能力带入 Pro 与 Flash 系列,提升复杂推理、代码和长上下文任务。
Gemini 2.0
强化原生工具调用与实时多模态输出,把“Agent 时代模型”作为主要产品方向。
Gemini 1.5 Flash / Flash-8B
低延迟、低成本档,把长上下文能力铺到高并发与移动端场景。
Gemini 1.5
用混合专家架构把上下文窗口推进到百万 token 级,长视频、长代码库与大文档成为核心场景。
Gemini 1.0
以 Ultra、Pro、Nano 三档推出原生多模态家族,统一文本、图像、音频与代码理解。
PaLM / PaLM 2
Gemini 之前的 Pathways 语言旗舰,支撑 Bard 早期能力与 API。