Gemini و دیگر مدلهای هوش مصنوعی مولد، ورودی و خروجی را با جزئیاتی به نام توکن پردازش میکنند.
برای مدلهای Gemini، یک توکن معادل حدود ۴ کاراکتر است. ۱۰۰ توکن معادل حدود ۶۰ تا ۸۰ کلمه انگلیسی است.
درباره توکنها
توکنها میتوانند کاراکترهای تکی مانند z یا کلمات کاملی مانند cat باشند. کلمات طولانی به چندین توکن تقسیم میشوند. مجموعه تمام توکنهای مورد استفاده توسط مدل، واژگان نامیده میشود و فرآیند تقسیم متن به توکنها، توکنسازی نامیده میشود.
وقتی صورتحساب فعال باشد، هزینه تماس با API جمینی تا حدودی توسط تعداد توکنهای ورودی و خروجی تعیین میشود، بنابراین دانستن نحوه شمارش توکنها میتواند مفید باشد.
تعداد توکنها
تمام ورودیها و خروجیهای API جمینی، از جمله متن، فایلهای تصویری و سایر موارد غیرمتنی، توکنسازی شدهاند.
شما میتوانید توکنها را به روشهای زیر بشمارید:
تابع
count_tokensرا با ورودی درخواست فراخوانی کنید. فقط تعداد کل توکنهای موجود در ورودی را برمیگرداند. این فراخوانی را قبل از ارسال ورودی انجام دهید تا اندازه درخواستهای شما بررسی شود.از میزان
usageدر پاسخ تعامل استفاده کنید. تعداد توکنها را برای ورودی (total_input_tokens)، خروجی (total_output_tokens)، تفکر (total_thought_tokens)، محتوای ذخیره شده (total_cached_tokens)، استفاده از ابزار (total_tool_use_tokens) و کل (total_tokens) برمیگرداند.
شمارش توکنهای متنی
پایتون
# This will only work for SDK newer than 2.0.0
from google import genai
client = genai.Client()
prompt = "The quick brown fox jumps over the lazy dog."
# Count tokens before sending
total_tokens = client.models.count_tokens(
model="gemini-3.7-flash",
contents=prompt
)
print("total_tokens:", total_tokens.total_tokens)
# Get usage from interaction
interaction = client.interactions.create(
model="gemini-3.7-flash",
input=prompt
)
print(interaction.usage)
جاوا اسکریپت
// This will only work for SDK newer than 2.0.0
import { GoogleGenAI } from '@google/genai';
const client = new GoogleGenAI({});
const prompt = "The quick brown fox jumps over the lazy dog.";
// Count tokens before sending
const countResponse = await client.models.countTokens({
model: "gemini-3.7-flash",
contents: prompt,
});
console.log(countResponse.totalTokens);
// Get usage from interaction
const interaction = await client.interactions.create({
model: "gemini-3.7-flash",
input: prompt,
});
console.log(interaction.usage);
استراحت
# Specifies the API revision to avoid breaking changes when they become default
curl -X POST "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.7-flash:countTokens" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"contents": [{"parts": [{"text": "The quick brown fox."}]}]}'
شمارش توکنهای چند نوبتی
شمارش توکنها در طول تاریخچه مکالمه با استفاده از previous_interaction_id :
پایتون
# This will only work for SDK newer than 2.0.0
# First interaction
interaction1 = client.interactions.create(
model="gemini-3.7-flash",
input="Hi, my name is Bob"
)
# Second interaction continues the conversation
interaction2 = client.interactions.create(
model="gemini-3.7-flash",
input="What's my name?",