نگارساشروع رایگان
دیوار یک استودیو با شانزده چاپ از یک گلدان سفالی که یکی از آن‌ها با ماژیک کهربایی دور گرفته شده، ساخته‌شده با هوش مصنوعی
راهنمای انتخاب مدل

راهنمای انتخاب مدل ساخت عکس با هوش مصنوعی

در نگارسا ۱۷ مدل ساخت عکس با هوش مصنوعی در دسترس توست و هیچ‌کدام «بهترین» نیستند؛ هرکدام برای کاری بهترین‌اند. این راهنما مدل‌ها را بر اساس کاری که می‌خواهی انجام بدهی مرتب می‌کند و نشان می‌دهد چطور به‌جای خرج کردن روی هر تصویر، فقط روی تصویری خرج کنی که واقعاً منتشر می‌شود.

زمان مطالعه: ۱۰ دقیقه۱۷ مدل، هرکدام با صفحه‌ی خودشقیمت‌ها به‌روز

شروع از اینجاانتخاب سریع بر اساس کاری که داری

سؤال درست «بهترین مدل ساخت عکس با هوش مصنوعی کدام است؟» نیست؛ «برای این کار مشخص، کدام مدل؟» است. جدول زیر همین را جواب می‌دهد: کار در ستون راست، و دو مدلی که ارزش امتحان کردن دارند در ستون چپ. روی نام هر مدل بزن تا صفحه‌ی کاملش را ببینی.

ایده‌پردازی سریع و ارزان

چند نسخه بساز، یکی را انتخاب کن، بعد روی مدل بالاتر ببر.

کار روزمره و همه‌منظوره

اگر نمی‌دانی از کجا شروع کنی، همین سطر جواب توست.

خروجی نهایی و کمپین

فقط برای همان یک تصویری که واقعاً منتشر می‌شود.

عکس محصول و تبلیغات

اگر عکس واقعی محصول را داری، آن را به‌عنوان مرجع بده تا مدل محصول را از نو اختراع نکند.

پوستر و متن داخل تصویر

متن دقیق را داخل گیومه بنویس و بگو هیچ متن دیگری ساخته نشود.

اینفوگرافیک، منو و دیاگرام

چیدمان اطلاعات از زیبایی صحنه مهم‌تر است.

ادیت یک بخش مشخص از عکس

تنها خانواده‌ای که می‌گذارد ناحیه‌ی مجاز تغییر را روی خود عکس علامت بزنی، GPT Image است.

حفظ چهره یا محصول در چند تصویر

با متن تنها نمی‌شود؛ باید تصویر مرجع بدهی.

ترکیب چند عکس مرجع

نقش هر عکس را در پرامپت بنویس: کدام چهره است، کدام لباس، کدام محیط.

تغییر سریع سبک

ترکیب‌بندی را ثابت نگه دار و فقط سبک رندر را عوض کن.

پس‌زمینه‌ی شفاف برای لوگو و استیکر

فقط خانواده‌ی GPT Image این را دارد، و خروجی باید PNG یا WebP باشد.

خروجی ۴K برای چاپ

خانواده‌ی FLUX تا حدود چهار مگاپیکسل می‌سازد و ۴K ندارد.

عکس واقع‌گرایانه بدون هیچ عکس مرجع

حالت RAW ظاهر صیقلی و ساختگی را کم می‌کند.

تصویری که به یک واقعیت روز نیاز دارد

فقط مدل‌های گوگل می‌توانند هنگام ساخت تصویر جست‌وجو کنند.

اگر فقط یک سطر از این جدول را می‌خوانی، همان سطر دوم است: برای کار روزمره نانو بنانا ۲ متعادل‌ترین انتخاب است و از آنجا می‌توانی بالا یا پایین بروی.

نقشه‌ی کلیچهار خانواده‌ی مدل، در یک نگاه

مدل‌های نگارسا از چهار سازنده می‌آیند و هر خانواده یک منطق دارد. وقتی خانواده را بشناسی، انتخاب بین اعضایش ساده می‌شود: تقریباً همیشه فرقشان سرعت در برابر دقت است.

نانو بنانا

ساخته‌ی گوگل

خانواده‌ی مدل‌های تصویری جمینای. یک مدل نیست: نسخه‌ی Lite برای سرعت و تولید انبوه، نسخه‌ی ۲ به‌عنوان مدل همه‌کاره، و نسخه‌ی Pro برای کارهایی که متن، اطلاعات و چند سوژه‌ی هم‌زمان دارند. تنها خانواده‌ای است که در نگارسا هم خروجی ارزان ۵۱۲ پیکسلی دارد و هم ۴K.

GPT Image

ساخته‌ی اوپن‌ای‌آی

مدل‌های تصویر اوپن‌ای‌آی. نقطه‌ی قوتشان پیروی دقیق از دستور، نوشتن متن ریز و ادیت است، و سه چیزی که هیچ خانواده‌ی دیگری در نگارسا ندارد: پس‌زمینه‌ی شفاف، انتخاب فرمت خروجی، و ماسک — یعنی می‌توانی روی خود عکس مشخص کنی کدام بخش اجازه‌ی تغییر دارد.

FLUX

ساخته‌ی Black Forest Labs

خانواده‌ای که به‌جای یک مدل، یک ردیف مدل می‌دهد: از Klein برای تکرار سریع تا Max برای بالاترین کیفیت. نسل تازه‌اش FLUX.2 است و نسل پیش از آن، Kontext، هنوز برای ادیت ارزش خودش را دارد.

Grok Imagine

ساخته‌ی xAI

مدل‌های تصویر xAI. دامنه‌ی سبکشان از عکس واقع‌گرایانه تا انیمه و نقاشی رنگ‌روغن باز است و هر سه مدل خانواده با یک پرامپت هم می‌سازند، هم ادیت می‌کنند و هم چند عکس را ترکیب می‌کنند.

عددی که کنار هر نام آمده، ارزان‌ترین تصویری است که آن مدل می‌سازد، به اعتبار. سقف قیمت هر مدل در فهرست پایین صفحه آمده است.

روش کارروند حرفه‌ای ساخت یک تصویر

اشتباه رایج این است که کار از گران‌ترین مدل و بالاترین کیفیت شروع شود. روش حرفه‌ای برعکس است: تصویر در چند مرحله ساخته می‌شود و هر مرحله مدل خودش را دارد. در مرحله‌ی ایده، سرعت و تعداد مهم است؛ در مرحله‌ی نهایی، جزئیات و خوانایی متن و ثبات چهره.

  1. ۱

    اول بگو تصویر کجا منتشر می‌شود

    پست مربع، استوری، بنر سایت، پوستر چاپی؟ نسبت تصویر را همان اول انتخاب کن، نه با بریدن تصویر در آخر کار. ۱:۱ برای پست، ۹:۱۶ برای استوری، ۱۶:۹ برای بنر و تصویر شاخص.

  2. ۲

    ایده بساز، نه تصویر نهایی

    با یک مدل سبک — نانو بنانا ۲ لایت، FLUX.2 Klein، یا ابعاد ۵۱۲ نانو بنانا ۲ — چند نسخه بساز. در این مرحله رزولوشن بالا هیچ ارزشی ندارد.

  3. ۳

    یکی را انتخاب کن

    از بین خروجی‌ها ترکیب‌بندی، زاویه، نور و سبک دلخواهت را انتخاب کن. اگر هیچ‌کدام درست نیست، کیفیت را بالا نبر — پرامپت را اصلاح کن.

  4. ۴

    طرح منتخب را با مدل قوی‌تر بساز

    همان پرامپت را به مدل مرحله‌ی بعد بده: نانو بنانا ۲ یا GPT Image 2.5 برای کار عمومی، نانو بنانا پرو برای متن و اطلاعات، FLUX.2 Max یا GPT Image 2.5 Sunburst برای خروجی نهایی.

  5. ۵

    ادیت را مرحله‌به‌مرحله انجام بده

    لباس، پس‌زمینه، نور و متن را در یک درخواست عوض نکن. هر نوبت یک تغییر اصلی، و هر بار صریح بنویس چه چیزهایی باید ثابت بمانند.

  6. ۶

    در اندازه‌ی واقعی کنترل کن

    چهره، دست‌ها، نوشته‌ها، لوگو، تعداد اشیا، سایه‌ها و پرسپکتیو را در اندازه‌ی واقعی نگاه کن، نه در بندانگشتی.

  7. ۷

    تازه حالا خروجی نهایی بگیر

    ابعاد و کیفیت را بر اساس جایی که تصویر واقعاً استفاده می‌شود انتخاب کن. برای وب همیشه ۴K لازم نیست؛ برای چاپ بزرگ شاید باشد.

کنتاکت‌شیت شانزده نسخه‌ی اولیه از یک گلدان سفالی آبی روی میز سنگی تیره، ساخته‌شده با هوش مصنوعی
مرحله‌ی دوم، به زبان تصویر: شانزده نسخه‌ی ارزان از یک ایده، تا معلوم شود کدام زاویه و کدام نور جواب می‌دهد. تصویر نهایی از روی یکی از این‌ها ساخته می‌شود، نه از صفر.

سوءتفاهم رایج«۴K» همه‌جا یک معنی ندارد

ابعاد خروجی، چیزی نیست که همه‌ی مدل‌ها سرش توافق داشته باشند. خانواده‌ی نانو بنانا تا ۴K می‌رود، خانواده‌ی FLUX.2 تا حدود چهار مگاپیکسل می‌سازد و اصلاً ۴K ندارد، مدل‌های Kontext هر تصویر را در حدود یک مگاپیکسل تحویل می‌دهند و Grok Imagine روی ۲K متوقف می‌شود. برای همین در نگارسا کنار هر مدل فقط همان ابعادی نوشته می‌شود که آن مدل واقعاً می‌سازد — نه بیشتر.

مدلابعاددرجه‌های کیفیتعکس مرجع
GPT Image 2.5 Flare جدید1K، 2K، 4Kپایین، متوسط، بالا، خیلی بالا، بیشینهتا ۱۶ تصویر
GPT Image 2.5 Sunburst جدید1K، 2K، 4Kپایین، متوسط، بالا، خیلی بالا، بیشینهتا ۱۶ تصویر
GPT Image 21K، 2K، 4Kپایین، متوسط، بالاتا ۱۶ تصویر
Nano Banana 2 Lite جدید1Kبدون سقف مشخص
Nano Banana 2512px، 1K، 2K، 4Kبدون سقف مشخص
Nano Banana Pro1K، 2K، 4Kبدون سقف مشخص
Nano Banana1Kبدون سقف مشخص
FLUX.2 Max1K، 2Kتا ۸ تصویر
FLUX.2 Pro1K، 2Kتا ۸ تصویر
FLUX.2 Flex1K، 2Kتا ۸ تصویر
FLUX.2 Klein1Kتا ۴ تصویر
FLUX.1 Kontext [max]1Kتا ۴ تصویر
FLUX.1 Kontext [pro]1Kتا ۴ تصویر
FLUX 1.1 [pro] Ultra2Kنمی‌گیرد؛ فقط از متن می‌سازد
Grok Imagine 2 جدید1K، 2Kپایین، متوسطتا ۵ تصویر
Grok Imagine 1 Quality1K، 2Kتا ۳ تصویر
Grok Imagine 11K، 2Kتا ۳ تصویر

نکته‌ی دوم: برای چاپ، عبارت «۴K» به‌تنهایی هیچ چیزی را تضمین نمی‌کند. کیفیت چاپ از سه چیز به دست می‌آید — ابعاد فیزیکی چاپ، تعداد پیکسل تصویر، و وضوح موردنیاز آن چاپ. اول اندازه‌ی چاپ را مشخص کن، بعد ببین ابعاد خروجی کافی است یا نه.

پوستر و تایپوگرافیمتن داخل تصویر با کدام مدل؟

نوشتن متن برای مدل‌های تصویر از کشیدن اشیا سخت‌تر است، و متن فارسی به‌دلیل حروف چسبان از انگلیسی هم سخت‌تر. سه مدل در نگارسا در این کار از بقیه جلوترند: نانو بنانا پرو برای متن طولانی و چیدمان اطلاعاتی، GPT Image 2.5 Sunburst برای متن ریز و شلوغ، و FLUX.2 Flex اگر در خانواده‌ی FLUX می‌مانی.

  • متن دقیق را داخل گیومه بنویس و جای آن را در قاب مشخص کن: «در بالای پوستر دقیقاً عبارت …».
  • صریح بگو هیچ متن دیگری در تصویر ساخته نشود.
  • متن را کوتاه نگه دار؛ یک تیتر و یک زیرتیتر، نه یک پاراگراف.
  • ×شماره تلفن، قیمت، آدرس و متن حقوقی را به مدل نسپار. تصویر و چیدمان را با مدل بساز و این متن‌ها را بعداً در ابزار طراحی روی تصویر بگذار.
پوستر تیره با تیتر انگلیسی و یک حجم هندسی کهربایی روی دیوار بتنی، ساخته‌شده با هوش مصنوعی
یک تیتر، یک زیرتیتر، و دستور صریح به اینکه هیچ متن دیگری ساخته نشود. هرچه متن کمتر و مشخص‌تر باشد، خروجی خواناتر است.

ویرایشادیت: کدام مدل چه چیزی را نگه می‌دارد

برای ادیت، پرامپت باید دو بخش روشن داشته باشد: چه چیزی عوض شود و چه چیزهایی دقیقاً ثابت بمانند. بخش دوم را بیشتر کاربران جا می‌اندازند و نتیجه‌اش این است که همراه با رنگ کت، چهره و نور هم کمی جابه‌جا می‌شود.

یک تفاوت فنی مهم هم هست: فقط خانواده‌ی GPT Image ماسک می‌پذیرد — یعنی می‌توانی روی خود عکس علامت بزنی که کدام بخش اجازه‌ی تغییر دارد و بقیه دست‌نخورده برمی‌گردد. روی مدل‌های گوگل، FLUX و Grok، ادیت موضعی را فقط می‌شود توصیف کرد، نه علامت زد.

ساختار پیشنهادی ادیتروی هر مدلی جواب می‌دهد

فقط پس‌زمینه را به یک استودیوی ساده‌ی کرم‌رنگ تغییر بده. چهره، مدل مو، حالت بدن، لباس، تناسب اندام، زاویه دوربین، برش قاب و جهت نور دقیقاً بدون تغییر بماند.

تصویر مرجعچند عکس مرجع و حفظ چهره

نگه داشتن یک چهره یا یک محصول در چند تصویر، با متن تنها ممکن نیست؛ باید عکس مرجع بدهی. سقف تعداد مرجع‌ها از مدلی به مدل دیگر فرق دارد و در جدول بالا آمده — از سه عکس در نسل اول Grok تا شانزده عکس در خانواده‌ی GPT Image.

مهم‌تر از تعداد، این است که نقش هر عکس را در پرامپت بنویسی. فرستادن چهار عکس و گفتن «این‌ها را ترکیب کن» تقریباً هیچ‌وقت نتیجه‌ی درستی نمی‌دهد؛ این می‌دهد:

نقش هر تصویر را بگوبرای کارهای چندمرجعی

تصویر ۱ = چهره و هویت شخصیت تصویر ۲ = لباس تصویر ۳ = سبک نورپردازی تصویر ۴ = محیط و لوکیشن یک تصویر تازه بساز که چهره‌ی تصویر ۱ را حفظ کند، لباس تصویر ۲ را پوشیده باشد، با نورپردازی تصویر ۳ و در محیط تصویر ۴.

سه قاب کنار هم از یک زن با روسری در استودیو، خیابان بارانی و کارگاه سفالگری با همان چهره، ساخته‌شده با هوش مصنوعی
یک چهره، سه صحنه. کاری که برای رسیدن به آن باید عکس مرجع بدهی و در هر مرحله فقط یک چیز را عوض کنی.

هزینهفهرست مدل‌ها، از ارزان به گران

قیمت هر تصویر پیش از ساختن مشخص است و به مدل، ابعاد و درجه‌ی کیفیت بستگی دارد. فهرست زیر ارزان‌ترین و گران‌ترین تصویری را که هر مدل می‌سازد نشان می‌دهد، به اعتبار، از ارزان به گران. ارزان‌ترین تصویری که امروز می‌شود ساخت ۱۰ اعتبار است.

GPT Image 2.5 Flare جدید۱۰ تا ۱,۱۳۹ اعتبار
GPT Image 2.5 Sunburst جدید۱۰ تا ۱,۱۳۹ اعتبار
GPT Image 2۱۰ تا ۱,۱۳۹ اعتبار
FLUX.2 Klein۲۴ اعتبار
Grok Imagine 1۳۲ تا ۶۴ اعتبار
FLUX.2 Pro۴۸ تا ۱۲۰ اعتبار
Nano Banana 2 Lite جدید۵۴ اعتبار
Nano Banana۶۲ اعتبار
FLUX.1 Kontext [pro]۶۴ اعتبار
Grok Imagine 2 جدید۶۴ تا ۱۲۸ اعتبار
Nano Banana 2۷۲ تا ۲۴۲ اعتبار
FLUX.2 Flex۸۰ تا ۲۰۰ اعتبار
Grok Imagine 1 Quality۸۰ تا ۱۱۲ اعتبار
FLUX 1.1 [pro] Ultra۹۶ اعتبار
FLUX.2 Max۱۱۲ تا ۲۵۶ اعتبار
FLUX.1 Kontext [max]۱۲۸ اعتبار
Nano Banana Pro۲۱۴ تا ۳۸۴ اعتبار

هزینه‌ی هر تصویر درست به همان اندازه که ساخته‌ای از موجودی کم می‌شود؛ نه اشتراک ماهانه، نه تمدید خودکار. مدل‌هایی که «فعلاً غیرفعال» شده‌اند در استودیو نمایش داده نمی‌شوند.

دو قانوندو قانونی که پول را هدر نمی‌دهند

کیفیت، مشکلِ پرامپت را حل نمی‌کند

اگر ترکیب‌بندی، زاویه، لباس یا تعداد اشیا اشتباه است، بردن کیفیت از «پایین» به «بالا» یا از 1K به 4K فقط نسخه‌ی باکیفیت‌تری از همان ایده‌ی اشتباه می‌سازد. اول پرامپت را درست کن، بعد رزولوشن را.

با هر ادیت فقط یک مشکل را حل کن

اگر چهره درست است ولی پس‌زمینه و لباس مشکل دارند، اول پس‌زمینه را اصلاح کن و بعد لباس. این کار احتمال جابه‌جا شدن چهره و ترکیب‌بندی را کم می‌کند.

اگر می‌خواهی خودِ پرامپت را بهتر بنویسی، آموزش کامل پرامپت‌نویسی برای ساخت تصویر با هوش مصنوعی شش لایه‌ی یک پرامپت خوب را جدا جدا توضیح می‌دهد، و کتابخانه‌ی پرامپت فارسی صدها پرامپت آماده دارد که می‌توانی همان‌طور که هستند به کار ببری.

پرسش و پاسخپرسش‌های پرتکرار

بهترین مدل ساخت عکس با هوش مصنوعی کدام است؟

بهترین مدل، مدلِ مرحله‌ی کار توست نه گران‌ترین مدل فهرست. برای ایده‌پردازی نانو بنانا ۲ لایت یا FLUX.2 Klein، برای کار روزمره نانو بنانا ۲، برای ادیت دقیق و خروجی نهایی GPT Image 2.5، و برای پوستر و متن نانو بنانا پرو. اگر قرار باشد فقط یکی پیشنهاد شود، نانو بنانا ۲ متعادل‌ترین انتخاب است.

«۴K» در همه‌ی مدل‌ها یک معنی دارد؟

نه. نانو بنانا ۲ و پرو خروجی ۴K دارند، خانواده‌ی FLUX.2 تا حدود چهار مگاپیکسل می‌سازد و اصلاً ۴K ندارد، و Grok Imagine حداکثر ۲K می‌دهد. برای همین در نگارسا کنار هر مدل دقیقاً همان ابعادی نوشته می‌شود که آن مدل واقعاً می‌سازد.

برای ادیت یک عکس موجود کدام مدل بهتر است؟

مدل‌های GPT Image 2.5، چون تنها مدل‌هایی هستند که ماسک می‌پذیرند: می‌توانی روی خود عکس مشخص کنی کدام بخش اجازه‌ی تغییر دارد. اگر ماسک لازم نداری، نانو بنانا ۲ و FLUX.1 Kontext هم ادیت‌های موضعی خوبی می‌دهند.

برای نوشتن متن داخل تصویر کدام مدل را انتخاب کنم؟

نانو بنانا پرو برای متن طولانی، چندزبانه و چیدمان اطلاعاتی مثل پوستر و منو؛ GPT Image 2.5 برای متن ریز و ادیت متن روی عکس موجود. متن دقیق را داخل گیومه بنویس و صریح بگو هیچ متن دیگری ساخته نشود. برای شماره تلفن، قیمت و آدرس بهتر است تصویر را بدون آن متن بسازی و نوشته را بعداً اضافه کنی.

کدام مدل پس‌زمینه‌ی شفاف می‌سازد؟

فقط خانواده‌ی GPT Image. خروجی هم باید PNG یا WebP باشد؛ JPEG شفافیت را نگه نمی‌دارد.

گران‌ترین مدل بهترین نتیجه را می‌دهد؟

نه لزوماً. مدل گران در مرحله‌ی اشتباه فقط هزینه را بالا می‌برد. روش حرفه‌ای این است که ایده را با مدل ارزان پیدا کنی و فقط همان یک تصویری را که واقعاً منتشر می‌شود با مدل گران بسازی.

پرامپت را فارسی بنویسم یا انگلیسی؟

در نگارسا فارسی بنویس. پرامپت فارسی پیش از ارسال به مدل به یک پرامپت انگلیسیِ عکاسانه بازنویسی می‌شود، پس لازم نیست انگلیسی بلد باشی. چیزی که اهمیت دارد دقت است، نه زبان.

حالا همین را امتحان کن

یک حساب تازه با اعتبار رایگان باز می‌شود. با یک مدل سبک چند ایده بساز، یکی را انتخاب کن و همان را با مدل نهایی بگیر.

رایگان شروع کن