ایمیجن (Imagen) مدل تولید تصویر با کیفیت بالای گوگل است که قادر به تولید تصاویر واقعی و با کیفیت بالا از پیامهای متنی است. همه تصاویر تولید شده شامل واترمارک SynthID هستند. برای کسب اطلاعات بیشتر در مورد انواع مدل ایمیجن موجود، به بخش نسخههای مدل مراجعه کنید.
مهاجرت به نانو موز
مدلهای Imagen منسوخ شدهاند و در ۱۷ آگوست ۲۰۲۶ از کار خواهند افتاد. توصیه میکنیم برای نیازهای تولید تصویر خود به Nano Banana مهاجرت کنید.
مهاجرت شامل تغییرات زیر است:
- نام مدل : به جای نام مدلهای Imagen از
gemini-2.5-flash-imageاستفاده کنید. - روش : به جای
client.models.generate_contentازclient.models.generate_imagesاستفاده کنید. - مدیریت پاسخ : نانو موز به جای یک شیء پاسخ تصویر خاص، بخشهایی از محتوا را برمیگرداند که ممکن است شامل دادههای تصویر باشد.
برای جزئیات و مثالهای بیشتر، به راهنمای تولید تصویر مراجعه کنید.
تولید تصاویر با استفاده از مدلهای Imagen
این مثال تولید تصاویر با مدل Imagen را نشان میدهد:
پایتون
from google import genai
from google.genai import types
from PIL import Image
from io import BytesIO
client = genai.Client()
response = client.models.generate_images(
model='imagen-4.0-generate-001',
prompt='Robot holding a red skateboard',
config=types.GenerateImagesConfig(
number_of_images= 4,
)
)
for generated_image in response.generated_images:
generated_image.image.show()
جاوا اسکریپت
import { GoogleGenAI } from "@google/genai";
import * as fs from "node:fs";
async function main() {
const ai = new GoogleGenAI({});
const response = await ai.models.generateImages({
model: 'imagen-4.0-generate-001',
prompt: 'Robot holding a red skateboard',
config: {
numberOfImages: 4,
},
});
let idx = 1;
for (const generatedImage of response.generatedImages) {
let imgBytes = generatedImage.image.imageBytes;
const buffer = Buffer.from(imgBytes, "base64");
fs.writeFileSync(`imagen-${idx}.png`, buffer);
idx++;
}
}
main();
برو
package main
import (
"context"
"fmt"
"os"
"google.golang.org/genai"
)
func main() {
ctx := context.Background()
client, err := genai.NewClient(ctx, nil)
if err != nil {
log.Fatal(err)
}
config := &genai.GenerateImagesConfig{
NumberOfImages: 4,
}
response, _ := client.Models.GenerateImages(
ctx,
"imagen-4.0-generate-001",
"Robot holding a red skateboard",
config,
)
for n, image := range response.GeneratedImages {
fname := fmt.Sprintf("imagen-%d.png", n)
_ = os.WriteFile(fname, image.Image.ImageBytes, 0644)
}
}
استراحت
curl -X POST \
"https://generativelanguage.googleapis.com/v1beta/models/imagen-4.0-generate-001:predict" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"instances": [
{
"prompt": "Robot holding a red skateboard"
}
],
"parameters": {
"sampleCount": 4
}
}'

پیکربندی ایمیجن
ایمیجن در حال حاضر فقط از زبان انگلیسی و پارامترهای زیر پشتیبانی میکند:
-
numberOfImages: تعداد تصاویری که باید تولید شوند، از ۱ تا ۴ (شامل). مقدار پیشفرض ۴ است. -
imageSize: اندازه تصویر تولید شده. این فقط برای مدلهای استاندارد و فوق العاده پشتیبانی میشود. مقادیر پشتیبانی شده1Kو2Kهستند. مقدار پیشفرض1Kاست. -
aspectRatio: نسبت ابعاد تصویر تولید شده را تغییر میدهد. مقادیر پشتیبانی شده عبارتند از"1:1"،"3:4"،"4:3"،"9:16"و"16:9". مقدار پیشفرض"1:1"است. personGeneration: به مدل اجازه میدهد تصاویر افراد را تولید کند. مقادیر زیر پشتیبانی میشوند:-
"dont_allow": جلوگیری از تولید تصاویر افراد. -
"allow_adult": تصاویر بزرگسالان را تولید میکند، اما تصاویر کودکان را تولید نمیکند. این مقدار پیشفرض است. -
"allow_all": تصاویری تولید میکند که شامل بزرگسالان و کودکان باشد.
-
راهنمای سریع Imagen
این بخش از راهنمای Imagen به شما نشان میدهد که چگونه تغییر یک درخواست تبدیل متن به تصویر میتواند نتایج متفاوتی ایجاد کند، به همراه نمونههایی از تصاویری که میتوانید ایجاد کنید.
اصول اولیه نوشتن سریع
یک متن خوب، توصیفی و واضح است و از کلمات کلیدی و توصیفکنندههای معنادار استفاده میکند. با در نظر گرفتن موضوع ، زمینه و سبک خود شروع کنید.

موضوع : اولین چیزی که باید در مورد هر سوالی در نظر بگیرید، موضوع است: شیء، شخص، حیوان یا منظرهای که میخواهید از آن تصویر بگیرید.
زمینه و پس زمینه: به همان اندازه که زمینه یا بستری که سوژه در آن قرار خواهد گرفت مهم است، سوژه خود را در پس زمینه های متنوعی قرار دهید. به عنوان مثال، یک استودیو با پس زمینه سفید، فضای باز یا محیط های داخلی.
سبک: در نهایت، سبک تصویر مورد نظر خود را اضافه کنید. سبکها میتوانند عمومی (نقاشی، عکس، طرحهای اولیه) یا بسیار خاص (نقاشی پاستل، طراحی با زغال، سهبعدی ایزومتریک) باشند. همچنین میتوانید سبکها را با هم ترکیب کنید.
بعد از اینکه اولین نسخه از ایدهتان را نوشتید، با اضافه کردن جزئیات بیشتر، ایدهتان را اصلاح کنید تا به تصویری که میخواهید برسید. تکرار مهم است. با مشخص کردن ایده اصلی خود شروع کنید و سپس آن ایده اصلی را اصلاح و گسترش دهید تا تصویر تولید شده به چشمانداز شما نزدیک شود.
![]() | ![]() | ![]() |
مدلهای ایمجین میتوانند ایدههای شما را به تصاویر دقیق تبدیل کنند، چه درخواستهای شما کوتاه باشند و چه طولانی و با جزئیات. چشمانداز خود را از طریق تکرار درخواستها اصلاح کنید و جزئیات را تا رسیدن به نتیجه کامل اضافه کنید.
دستورالعملهای کوتاه به شما امکان میدهند به سرعت یک تصویر ایجاد کنید. ![]() | درخواستهای طولانیتر به شما امکان میدهند جزئیات خاصی را اضافه کنید و تصویر خود را بسازید. ![]() |
توصیههای اضافی برای نوشتن سریع Imagen:
- از زبان توصیفی استفاده کنید : از صفتها و قیدهای دقیق برای ترسیم تصویری واضح برای Imagen استفاده کنید.
- زمینه را فراهم کنید : در صورت لزوم، اطلاعات پیشزمینه را برای کمک به درک هوش مصنوعی ارائه دهید.
- ارجاع به هنرمندان یا سبکهای خاص : اگر زیباییشناسی خاصی را در ذهن دارید، ارجاع به هنرمندان یا جنبشهای هنری خاص میتواند مفید باشد.
- از ابزارهای مهندسی سریع استفاده کنید : برای کمک به اصلاح دستورالعملهای خود و دستیابی به نتایج بهینه، ابزارها یا منابع مهندسی سریع را بررسی کنید.
- بهبود جزئیات چهره در تصاویر شخصی و گروهی : جزئیات چهره را به عنوان نقطه کانونی عکس مشخص کنید (برای مثال، از کلمه "پرتره" در سوال استفاده کنید).
تولید متن در تصاویر
مدلهای Imagen میتوانند متن را به تصاویر اضافه کنند و امکانات خلاقانهتری برای تولید تصویر فراهم کنند. برای بهرهمندی هرچه بیشتر از این ویژگی، از راهنماییهای زیر استفاده کنید:
- با اطمینان تکرار کنید : ممکن است مجبور شوید تصاویر را دوباره تولید کنید تا به ظاهر دلخواه خود برسید. ادغام متن Imagen هنوز در حال تکامل است و گاهی اوقات چندین تلاش بهترین نتایج را به همراه دارد.
- کوتاه نگه دارید : برای تولید بهینه، متن را به ۲۵ کاراکتر یا کمتر محدود کنید.
عبارات چندگانه : برای ارائه اطلاعات بیشتر، با دو یا سه عبارت مجزا آزمایش کنید. برای نوشتن متنهای تمیزتر، از بیش از سه عبارت استفاده نکنید.

نکته: پوستری با عنوان «سرزمین تابستان» با فونت پررنگ، که در زیر آن شعار «تابستان هیچوقت اینقدر خوب نبوده» نوشته شده است. قرار دادن متن در راهنما : اگرچه Imagen میتواند متن را طبق دستورالعمل قرار دهد، اما انتظار تغییرات گاه به گاه را داشته باشید. این ویژگی به طور مداوم در حال بهبود است.
الهام بخشیدن به سبک فونت : یک سبک فونت کلی را مشخص کنید تا به طور نامحسوس بر انتخابهای Imagen تأثیر بگذارد. به تکرار دقیق فونت تکیه نکنید، بلکه انتظار تفسیرهای خلاقانه را داشته باشید.
اندازه فونت : اندازه فونت یا یک شاخص کلی برای اندازه (مثلاً کوچک ، متوسط ، بزرگ ) را برای تأثیرگذاری بر تولید اندازه فونت مشخص کنید.
پارامتردهی سریع
برای کنترل بهتر نتایج خروجی، ممکن است پارامتری کردن ورودیها در Imagen مفید باشد. برای مثال، فرض کنید میخواهید مشتریانتان بتوانند برای کسب و کار خود لوگو تولید کنند و میخواهید مطمئن شوید که لوگوها همیشه با پسزمینهای تک رنگ تولید میشوند. همچنین میخواهید گزینههایی را که مشتری میتواند از یک منو انتخاب کند، محدود کنید.
در این مثال، میتوانید یک اعلان پارامتری مشابه زیر ایجاد کنید:
A {logo_style} logo for a {company_area} company on a solid color background. Include the text {company_name}.در رابط کاربری سفارشی شما، مشتری میتواند پارامترها را با استفاده از یک منو وارد کند و مقدار انتخابی او در اعلان دریافتی Imagen نمایش داده میشود.
برای مثال:
نکته:
A minimalist logo for a health care company on a solid color background. Include the text Journey .




