本指南將介紹 Gemini API 提供的所有模型。
Gemini 3
穩定
Gemini 3.6 Flash
Google 最新的模型,兼具速度與智慧,可在代理功能和多模態工作提供強大效能。
穩定
Gemini 3.5 Flash
這是 Google 迄今最聰明的模型,可以在代理功能和程式設計工作持續提供頂尖效能。
穩定
Gemini 3.5 Flash-Lite
這是我們速度最快、成本效益最高的 3.5 模型,適用於高輸送量執行作業。
穩定
Gemini 3.1 Flash-Lite
效能可與大型模型匹敵,但成本遠低於大型模型。
穩定
Nano Banana 2
強大高效的圖像生成和編輯功能,可快速處理大量使用案例。
穩定
Nano Banana 2 Lite
超低延遲且符合成本效益的圖像生成和編輯模型,專為高流量互動式用途設計。
穩定
Nano Banana Pro
最先進的圖像生成和編輯模型,可根據情境建立原生圖像。
穩定
預覽
Gemini 3.1 Pro
進階智慧、複雜問題解決能力,以及強大的代理和氛圍編碼功能。
預覽
Gemini 3 Flash
效能可與大型模型匹敵,但成本遠低於大型模型。
預覽
Gemini 3.5 Live Translate
低延遲的即時語音對語音翻譯模型,支援超過 70 種語言。
新預覽
Gemini 3.1 Flash Live
高品質低延遲的 Live API 模型,適用於即時對話和以語音為主的 AI 應用程式。
新預覽
Gemini 3.1 Flash TTS
強大且低延遲的語音生成功能。
新預覽
Gemini Omni Flash
快速生成及編輯影片,就像聊天一樣簡單。將文字和圖片轉換成影片,並透過自然語言調整結果。
新預覽
所有 Gemini 3 模型
| 模型 | 端點 |
|---|---|
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.5 Live Translate | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | gemini-3.1-flash-tts-preview |
Gemini 2.5 Flash
| 模型 | 說明 | 端點 |
|---|---|---|
| Gemini 2.5 Flash | 我們提供最佳成本效益的模型,適用於需要推論能力的大量低延遲工作。 | gemini-2.5-flash |
| Nano Banana | 最先進的圖像生成和編輯功能,專為快速的創作工作流程設計。 | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | 專為即時對話式代理程式設計,可串流原生音訊,延遲時間不到一秒。 | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | 可控制的文字轉語音音訊生成功能,可精細控制風格和速度。 | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash-Lite
| 模型 | 說明 | 端點 |
|---|---|---|
| Gemini 2.5 Flash-Lite | 2.5 系列中速度最快、最經濟實惠的多模態模型。 | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| 模型 | 說明 | 端點 |
|---|---|---|
| Gemini 2.5 Pro | 這是 Google 最先進的模型,專為處理複雜任務而設計,具備 2.5 系列的深層推論和程式設計能力。 | gemini-2.5-pro |
| Gemini 2.5 Pro TTS | 高保真語音合成技術,可針對 Podcast 和有聲書等結構化工作流程,提供最佳音質。 | gemini-2.5-pro-preview-tts |
音訊模型
這個部分包含所有音訊模型,包括可能已列在其他部分中的模型
| 模型 | 說明 | 端點 |
|---|---|---|
| Gemini 3.1 Flash Live | 我們的高品質低延遲音訊對音訊 (A2A) 模型,專為即時對話和語音優先 AI 應用程式設計。 | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | 生成語音的延遲時間短,輸出內容自然,可透過提示詞控制,並提供新的生動音訊標記,精確控制旁白。 | gemini-3.1-flash-tts-preview |
| Gemini 2.5 Flash Live | 我們的旗艦 Live API 模型,適用於低延遲雙向語音和視訊代理,並具備原生音訊推論功能。 | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | 快速生成可控制的文字轉語音音訊,適用於低延遲、經濟實惠的應用程式和即時助理。 | gemini-2.5-flash-preview-tts |
| Gemini 2.5 Pro TTS | 高保真語音合成技術,可針對 Podcast 和有聲書等結構化工作流程,提供最佳音質。 |