הפרמטר media_resolution קובע איך Gemini API מעבד קלט של מדיה כמו תמונות, סרטונים ומסמכי PDF. הוא מגדיר את מספר הטוקנים המקסימלי שמוקצה לקלט של מדיה, וכך מאפשר לכם לאזן בין איכות התגובה לבין זמן האחזור והעלות. בקטע ספירת אסימונים מפורטים ערכי ברירת המחדל של הגדרות שונות והאסימונים שמתאימים להן.
אתם יכולים להגדיר את רזולוציית המדיה לאובייקטים ספציפיים של מדיה (פריטי תוכן) בבקשה (רק ב-Gemini 3).
רזולוציית מדיה לכל פריט תוכן (Gemini 3 בלבד)
Gemini 3 מאפשר לכם להגדיר רזולוציית מדיה לאובייקטים ספציפיים של מדיה בבקשה, וכך לבצע אופטימיזציה פרטנית של השימוש בטוקנים. אפשר לשלב רמות רזולוציה שונות בבקשה אחת. לדוגמה, שימוש ברזולוציה גבוהה לתרשים מורכב וברזולוציה נמוכה לתמונה פשוטה שמוסיפה הקשר.
Python
from google import genai
client = genai.Client()
myfile = client.files.upload(file="path/to/image.jpg")
interaction = client.interactions.create(
model="gemini-3.6-flash",
input=[
{"type": "text", "text": "Describe this image:"},
{
"type": "image",
"uri": myfile.uri,
"mime_type": myfile.mime_type,
"resolution": "high"
}
]
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const myfile = await ai.files.upload({
file: "path/to/image.jpg",
config: { mime_type: "image/jpeg" },
});
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: [
{ type: "text", text: "Describe this image:" },
{
type: "image",
uri: myfile.uri,
mime_type: myfile.mimeType,
resolution: "high"
}
],
});
console.log(interaction.output_text);
}
await main();
REST
# First upload the file using the Files API, then use the URI:
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.6-flash",
"input": [
{"type": "text", "text": "Describe this image:"},
{
"type": "image",
"uri": "YOUR_FILE_URI",
"mime_type": "image/jpeg",
"resolution": "high"
}
]
}'
ערכי הרזולוציה הזמינים
ב-Gemini API מוגדרות הרמות הבאות של רזולוציית מדיה:
-
unspecified: הגדרת ברירת המחדל. מספר הטוקנים ברמה הזו משתנה באופן משמעותי בין Gemini 3 לבין מודלים קודמים של Gemini. -
low: מספר האסימונים נמוך יותר, ולכן העיבוד מהיר יותר והעלות נמוכה יותר, אבל יש פחות פרטים. -
medium: איזון בין רמת הפירוט, העלות וזמן האחזור. -
high: מספר גבוה יותר של טוקנים, שמספק למודל יותר פרטים לעבודה, אבל על חשבון עלות גבוהה יותר וזמן אחזור ארוך יותר. -
ultra_high(לכל פריט תוכן בלבד): כמות הטוקנים הגבוהה ביותר, נדרש לתרחישי שימוש ספציפיים כמו שימוש במחשב.
חשוב לזכור שההגדרה high מספקת את הביצועים האופטימליים ברוב תרחישי השימוש.
המספר המדויק של הטוקנים שנוצרו לכל אחת מהרמות האלה תלוי בסוג המדיה (תמונה, סרטון, PDF) ובגרסת המודל.
מספר הטוקנים
בטבלאות הבאות מפורטות ספירות האסימונים המשוערות לכל ערך של media_resolution ולכל סוג מדיה לכל משפחת מודלים.
מודלים של Gemini 3
| MediaResolution | תמונה | וידאו | |
|---|---|---|---|
unspecified (ברירת מחדל) |
1120 | 70 | 560 |
low |
280 | 70 | 280 + טקסט מותאם |