Gemini 是 Google DeepMind 的 AI 模型家族,可以在 Gemini App、透過 API,以及在 Google Workspace 裡使用。它涵蓋文字與多模態模型,另外還有獨立的圖像和影片生成模型,並且以世代推出,每一代都沿用相同的層級名稱。


Google 的 Gemini 模型家族自推出以来不断扩展,现已覆盖多个世代和能力层级。从面向高吞吐量的 Flash-Lite,到 Pro 的前沿推理能力,几乎每一种使用场景和预算都能找到合适的 Gemini 模型。本指南按从新到旧的顺序列出所有主要 Google Gemini 模型,简要介绍各模型的规格、核心功能和适用场景,并附上可在 Chat Smith 试用的模型链接。

Gemini 3.6 Flash 于 2026 年 7 月 21 日发布,是 Google 最新的中端主力模型。它的基础智能水平与 Gemini 3.5 Flash 相同(Artificial Analysis Index:50),但完成相同任务时输出 token 约减少 17%,每百万输出 token 的价格也从 $9.00 降至 $7.50。知识截止日期推进至 2026 年 3 月。基准测试显示,它在智能体编程(DeepSWE:49% 对 37%)、计算机操作(OSWorld:83% 对 78.4%)和机器学习研究(MLE-Bench:63.9% 对 49.7%)方面都有明显提升。上下文窗口:1M token。速度:约 275 tok/s。最适合:智能体编程、文档分析和知识工作。
同样于 2026 年 7 月 21 日推出的 Gemini 3.5 Flash-Lite,是 3.5 系列中速度最快、成本最低的模型。输出速度为每秒 350 token,定价为输入 $0.30/1M、输出 $2.50/1M。虽然价格更低,但它在智能体和编程基准测试中明显优于 3.1 Flash-Lite(SWE-Bench Pro:54.2% 对 31%)。可配置的思考层级从最低到最高,让开发者在速度与质量之间取得平衡。最适合:高吞吐量流程、智能体搜索和文档处理。
Gemini 3.5 Flash 于 Google I/O 2026 发布,Gemini 3.5 Flash 是面向复杂长周期任务的前沿智能体模型。它在编程和智能体基准测试中可与大型旗舰模型竞争,同时保持 Flash 系列的速度。支持文本、图像、音频和视频多模态输入,拥有 1M token 上下文并能可靠遵循指令,因此非常适合生产环境。定价:输入 $1.50/1M、输出 $9.00/1M。
Gemini 3.1 Flash-Lite 是 Google 3 系列中成本最低的模型,针对高并发且对延迟敏感的任务进行了优化。它新增从最低到最高的灵活思考层级,可平衡速度和质量;音频输入也有所改进,关键能力与 Gemini 2.5 Flash 相当。定价:输入 $0.25/1M、输出 $1.50/1M。速度:约 363 tok/s。上下文:1M token。最适合:大规模分类、聊天机器人和指令密集型工作流。
Gemini 3.1 Pro 是 3.1 世代的旗舰模型,面向最复杂的推理、编程和长上下文任务。在 Artificial Analysis Intelligence Index 上得分 46,适用于需要大规模高准确率的企业场景。定价:输入约 $2.00/1M、输出约 $12.00/1M。速度:约 145 tok/s。上下文:超过 1M token。最适合:深度推理、复杂多步工作流和企业流程。
更多内容:Gemini 3.1 Pro 完整评测
Gemini 3 Flash 是兼顾速度、效率和强大多模态能力的模型。它可在 1M token 上下文窗口中处理文本、图像、音频和视频输入,并在 3.5 世代推出前广泛用于生产应用。最适合:通用对话、摘要、分类和快速原型开发。
更多内容:Gemini 3 Flash 完整评测
Gemini 3 Pro 是 Gemini 3 世代中能力最强的模型,面向前沿推理和复杂任务执行。在 Flash 的多模态优势基础上,它进一步增强了分析深度、指令遵循和长上下文理解。最适合:深度研究、复杂文档流程和高风险推理任务。
更多内容:Gemini 3 Pro 完整评测
Nano Banana 是 Google 的原生图像生成与编辑模型,正式归属于 Gemini 图像模型家族。它支持多图融合、角色一致性、风格控制,以及在对话式工作流中进行迭代编辑。提供两个版本:Nano Banana(标准版)和 Nano Banana Pro(输出质量更高),两者都可在 Chat Smith 使用。最适合:AI 图像生成、照片编辑、品牌视觉和角色创作。
Gemini 2.5 Pro 是 Google 首个混合推理模型,拥有 1M token 上下文窗口和可配置的思考预算。它在复杂编程、分析和多步推理任务中表现出色,发布时被广泛视为同级别中的顶尖模型之一。定价:输入 $1.25/1M、输出 $10.00/1M。最适合:复杂推理、编程和文档分析。
更多内容:Gemini 2.5 Pro 完整评测
Gemini 2.5 Flash 是一款快速且能力出色的生产模型,可为高并发应用平衡成本与性能。它支持 1M token 上下文窗口、多模态输入,并通过 Gemini API 提供充裕的免费额度。定价:输入 $0.30/1M、输出 $2.50/1M。速度:约 249 tok/s。最适合:聊天机器人、内容分类、翻译和快速原型开发。
Gemini 2.5 Flash-Lite 是 Google 的经济型冠军:以输入 $0.10/1M、输出 $0.40/1M 的价格,成为市场上配备 1M token 上下文窗口的最低价模型。速度约 366 tok/s,也是目前最快的模型之一。最适合:重视成本的高并发工作负载,其中速度和价格比深度推理更重要。
Gemini 2.0 Flash 是 Google 上一代的主力模型,以对文本、图像、音频和视频进行快速多模态响应而著称。它已于 2026 年 6 月 1 日停用,Gemini API 也不再提供。原有用户现应迁移到 Gemini 3 Flash 或 3.1 Flash-Lite。最适合:仅作历史参考;请迁移到新模型。
Gemini 1.5 Flash 于 2024 年 5 月发布,是当时具有里程碑意义的模型,也是首个以开发者友好价格提供 1M token 上下文窗口的 Flash 级模型。它由 Gemini 1.5 Pro 蒸馏而来,支持文本、图像、音频和视频输入,吞吐量约 190 tok/s。定价:输入 $0.075–$0.15/1M、输出 $0.30–$0.60/1M。虽然已被新世代取代,但它仍是了解 Flash 产品线演进的重要历史参考。
Google 的 Gemini 产品线现已覆盖三个主要世代和多个能力层级,从经济型 Flash-Lite 到 Pro 的前沿推理。对于希望使用这些模型、又不想管理 API 密钥的开发者和团队,Chat Smith 可在一个界面中提供完整的 Gemini 产品线,以及 GPT、Claude、Grok 和 DeepSeek。浏览 Chat Smith 完整模型目录,即可找到适合你工作流程的 Gemini 模型。
Gemini 是 Google DeepMind 的 AI 模型家族,可以在 Gemini App、透過 API,以及在 Google Workspace 裡使用。它涵蓋文字與多模態模型,另外還有獨立的圖像和影片生成模型,並且以世代推出,每一代都沿用相同的層級名稱。
