本指南将介绍可通过 Gemini API 使用的所有模型。
Gemini 3
稳定
Gemini 3.6 Flash
Google 推出的最新模型,在速度和智能性之间实现了平衡,可在智能体和多模态任务中提供出色的性能。
稳定
Gemini 3.5 Flash
最智能的模型,可在智能体和编程任务中持续提供前沿性能。
稳定
Gemini 3.5 Flash-Lite
Google 旗下最快、最具成本效益的 3.5 模型,可实现高吞吐量执行。
稳定
Gemini 3.1 Flash-Lite
以远低于大型模型的成本,实现可与 Frontier 级模型相媲美的性能。
稳定
Nano Banana 2
功能强大、高效的图片生成和编辑模型,专为极致速度与大规模量产场景而优化。
稳定
Nano Banana 2 Lite
超低延迟且经济实惠的图片生成和编辑功能,专为高流量互动应用场景而设计。
稳定
Nano Banana Pro
前沿图片生成和编辑模型,可根据上下文高度相关地创建原生图片。
稳定
预览
Gemini 3.1 Pro
具备高级智能、复杂问题解决能力,以及强大的智能体和氛围编程 (vibe coding) 能力。
预览
Gemini 3 Flash
以远低于大型模型的成本,实现可与 Frontier 级模型相媲美的性能。
预览
Gemini 3.5 实时翻译
低延迟的实时语音翻译模型,支持 70 多种语言。
新预览
Gemini 3.1 Flash Live
高品质、低延迟的 Live API 模型,适用于实时对话和以语音为主的 AI 应用。
新预览
Gemini 3.1 Flash TTS
功能强大、低延迟的语音生成。
新预览
Gemini Omni Flash
快速生成和编辑视频,并支持对话式操作。将文字和图片转换为视频,并通过自然语言优化结果。
新预览
所有 Gemini 3 模型
| 模型 | 端点 |
|---|---|
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.5 实时翻译 | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | gemini-3.1-flash-tts-preview |
Gemini 2.5 Flash
| 模型 | 说明 | 端点 |
|---|---|---|
| Gemini 2.5 Flash | 在性价比方面表现出色的模型,适合需要推理的低延迟、高数据量任务。 | gemini-2.5-flash |
| Nano Banana | 前沿的原生图片生成和编辑功能,专为快速创意工作流而设计。 | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | 经过优化,可用于亚秒级原生音频流式传输的实时对话代理。 | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | 可控的文字转语音音频生成,可精细控制风格和节奏。 | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash-Lite
| 模型 | 说明 | 端点 |
|---|---|---|
| Gemini 2.5 Flash-Lite | 2.5 系列中最快且最具预算友好性的多模态模型。 | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| 模型 | 说明 | 端点 |
|---|---|---|
| Gemini 2.5 Pro | Google 旗下最先进的模型,可用于处理复杂任务,在 2.5 系列中具有出色的深度推理和编码能力。 | gemini-2.5-pro |
| Gemini 2.5 Pro TTS | 高保真语音合成,针对播客和有声读物等结构化工作流程中的质量进行了优化。 | gemini-2.5-pro-preview-tts |
音频模型
此部分包含所有音频模型,包括可能已在其他部分列出的模型
| 模型 | 说明 | 端点 |
|---|---|---|
| Gemini 3.1 Flash Live | Google 的高品质低延迟音频转音频 (A2A) 模型,专为实时对话和语音优先 AI 应用而设计。 | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | 强大的低延迟语音生成能力,语音输出自然流畅,提示可引导,并新增了富有表现力的音频标记,可实现精准的旁白控制。 | gemini-3.1-flash-tts-preview |
| Gemini 2.5 Flash Live | 我们的旗舰版 Live API 模型,适用于低延迟、双向语音和视频代理,具有原生音频推理功能。 |