
راهنمای انتخاب مدل ساخت عکس با هوش مصنوعی
در نگارسا ۱۷ مدل ساخت عکس با هوش مصنوعی در دسترس توست و هیچکدام «بهترین» نیستند؛ هرکدام برای کاری بهتریناند. این راهنما مدلها را بر اساس کاری که میخواهی انجام بدهی مرتب میکند و نشان میدهد چطور بهجای خرج کردن روی هر تصویر، فقط روی تصویری خرج کنی که واقعاً منتشر میشود.
شروع از اینجاانتخاب سریع بر اساس کاری که داری
سؤال درست «بهترین مدل ساخت عکس با هوش مصنوعی کدام است؟» نیست؛ «برای این کار مشخص، کدام مدل؟» است. جدول زیر همین را جواب میدهد: کار در ستون راست، و دو مدلی که ارزش امتحان کردن دارند در ستون چپ. روی نام هر مدل بزن تا صفحهی کاملش را ببینی.
چند نسخه بساز، یکی را انتخاب کن، بعد روی مدل بالاتر ببر.
اگر نمیدانی از کجا شروع کنی، همین سطر جواب توست.
فقط برای همان یک تصویری که واقعاً منتشر میشود.
اگر عکس واقعی محصول را داری، آن را بهعنوان مرجع بده تا مدل محصول را از نو اختراع نکند.
متن دقیق را داخل گیومه بنویس و بگو هیچ متن دیگری ساخته نشود.
چیدمان اطلاعات از زیبایی صحنه مهمتر است.
تنها خانوادهای که میگذارد ناحیهی مجاز تغییر را روی خود عکس علامت بزنی، GPT Image است.
با متن تنها نمیشود؛ باید تصویر مرجع بدهی.
نقش هر عکس را در پرامپت بنویس: کدام چهره است، کدام لباس، کدام محیط.
ترکیببندی را ثابت نگه دار و فقط سبک رندر را عوض کن.
فقط خانوادهی GPT Image این را دارد، و خروجی باید PNG یا WebP باشد.
خانوادهی FLUX تا حدود چهار مگاپیکسل میسازد و ۴K ندارد.
حالت RAW ظاهر صیقلی و ساختگی را کم میکند.
فقط مدلهای گوگل میتوانند هنگام ساخت تصویر جستوجو کنند.
اگر فقط یک سطر از این جدول را میخوانی، همان سطر دوم است: برای کار روزمره نانو بنانا ۲ متعادلترین انتخاب است و از آنجا میتوانی بالا یا پایین بروی.
نقشهی کلیچهار خانوادهی مدل، در یک نگاه
مدلهای نگارسا از چهار سازنده میآیند و هر خانواده یک منطق دارد. وقتی خانواده را بشناسی، انتخاب بین اعضایش ساده میشود: تقریباً همیشه فرقشان سرعت در برابر دقت است.
نانو بنانا
ساختهی گوگل
خانوادهی مدلهای تصویری جمینای. یک مدل نیست: نسخهی Lite برای سرعت و تولید انبوه، نسخهی ۲ بهعنوان مدل همهکاره، و نسخهی Pro برای کارهایی که متن، اطلاعات و چند سوژهی همزمان دارند. تنها خانوادهای است که در نگارسا هم خروجی ارزان ۵۱۲ پیکسلی دارد و هم ۴K.
GPT Image
ساختهی اوپنایآی
مدلهای تصویر اوپنایآی. نقطهی قوتشان پیروی دقیق از دستور، نوشتن متن ریز و ادیت است، و سه چیزی که هیچ خانوادهی دیگری در نگارسا ندارد: پسزمینهی شفاف، انتخاب فرمت خروجی، و ماسک — یعنی میتوانی روی خود عکس مشخص کنی کدام بخش اجازهی تغییر دارد.
FLUX
ساختهی Black Forest Labs
خانوادهای که بهجای یک مدل، یک ردیف مدل میدهد: از Klein برای تکرار سریع تا Max برای بالاترین کیفیت. نسل تازهاش FLUX.2 است و نسل پیش از آن، Kontext، هنوز برای ادیت ارزش خودش را دارد.
Grok Imagine
ساختهی xAI
مدلهای تصویر xAI. دامنهی سبکشان از عکس واقعگرایانه تا انیمه و نقاشی رنگروغن باز است و هر سه مدل خانواده با یک پرامپت هم میسازند، هم ادیت میکنند و هم چند عکس را ترکیب میکنند.
عددی که کنار هر نام آمده، ارزانترین تصویری است که آن مدل میسازد، به اعتبار. سقف قیمت هر مدل در فهرست پایین صفحه آمده است.
روش کارروند حرفهای ساخت یک تصویر
اشتباه رایج این است که کار از گرانترین مدل و بالاترین کیفیت شروع شود. روش حرفهای برعکس است: تصویر در چند مرحله ساخته میشود و هر مرحله مدل خودش را دارد. در مرحلهی ایده، سرعت و تعداد مهم است؛ در مرحلهی نهایی، جزئیات و خوانایی متن و ثبات چهره.
- ۱
اول بگو تصویر کجا منتشر میشود
پست مربع، استوری، بنر سایت، پوستر چاپی؟ نسبت تصویر را همان اول انتخاب کن، نه با بریدن تصویر در آخر کار. ۱:۱ برای پست، ۹:۱۶ برای استوری، ۱۶:۹ برای بنر و تصویر شاخص.
- ۲
ایده بساز، نه تصویر نهایی
با یک مدل سبک — نانو بنانا ۲ لایت، FLUX.2 Klein، یا ابعاد ۵۱۲ نانو بنانا ۲ — چند نسخه بساز. در این مرحله رزولوشن بالا هیچ ارزشی ندارد.
- ۳
یکی را انتخاب کن
از بین خروجیها ترکیببندی، زاویه، نور و سبک دلخواهت را انتخاب کن. اگر هیچکدام درست نیست، کیفیت را بالا نبر — پرامپت را اصلاح کن.
- ۴
طرح منتخب را با مدل قویتر بساز
همان پرامپت را به مدل مرحلهی بعد بده: نانو بنانا ۲ یا GPT Image 2.5 برای کار عمومی، نانو بنانا پرو برای متن و اطلاعات، FLUX.2 Max یا GPT Image 2.5 Sunburst برای خروجی نهایی.
- ۵
ادیت را مرحلهبهمرحله انجام بده
لباس، پسزمینه، نور و متن را در یک درخواست عوض نکن. هر نوبت یک تغییر اصلی، و هر بار صریح بنویس چه چیزهایی باید ثابت بمانند.
- ۶
در اندازهی واقعی کنترل کن
چهره، دستها، نوشتهها، لوگو، تعداد اشیا، سایهها و پرسپکتیو را در اندازهی واقعی نگاه کن، نه در بندانگشتی.
- ۷
تازه حالا خروجی نهایی بگیر
ابعاد و کیفیت را بر اساس جایی که تصویر واقعاً استفاده میشود انتخاب کن. برای وب همیشه ۴K لازم نیست؛ برای چاپ بزرگ شاید باشد.

سوءتفاهم رایج«۴K» همهجا یک معنی ندارد
ابعاد خروجی، چیزی نیست که همهی مدلها سرش توافق داشته باشند. خانوادهی نانو بنانا تا ۴K میرود، خانوادهی FLUX.2 تا حدود چهار مگاپیکسل میسازد و اصلاً ۴K ندارد، مدلهای Kontext هر تصویر را در حدود یک مگاپیکسل تحویل میدهند و Grok Imagine روی ۲K متوقف میشود. برای همین در نگارسا کنار هر مدل فقط همان ابعادی نوشته میشود که آن مدل واقعاً میسازد — نه بیشتر.
| مدل | ابعاد | درجههای کیفیت | عکس مرجع |
|---|---|---|---|
| GPT Image 2.5 Flare جدید | 1K، 2K، 4K | پایین، متوسط، بالا، خیلی بالا، بیشینه | تا ۱۶ تصویر |
| GPT Image 2.5 Sunburst جدید | 1K، 2K، 4K | پایین، متوسط، بالا، خیلی بالا، بیشینه | تا ۱۶ تصویر |
| GPT Image 2 | 1K، 2K، 4K | پایین، متوسط، بالا | تا ۱۶ تصویر |
| Nano Banana 2 Lite جدید | 1K | — | بدون سقف مشخص |
| Nano Banana 2 | 512px، 1K، 2K، 4K | — | بدون سقف مشخص |
| Nano Banana Pro | 1K، 2K، 4K | — | بدون سقف مشخص |
| Nano Banana | 1K | — | بدون سقف مشخص |
| FLUX.2 Max | 1K، 2K | — | تا ۸ تصویر |
| FLUX.2 Pro | 1K، 2K | — | تا ۸ تصویر |
| FLUX.2 Flex | 1K، 2K | — | تا ۸ تصویر |
| FLUX.2 Klein | 1K | — | تا ۴ تصویر |
| FLUX.1 Kontext [max] | 1K | — | تا ۴ تصویر |
| FLUX.1 Kontext [pro] | 1K | — | تا ۴ تصویر |
| FLUX 1.1 [pro] Ultra | 2K | — | نمیگیرد؛ فقط از متن میسازد |
| Grok Imagine 2 جدید | 1K، 2K | پایین، متوسط | تا ۵ تصویر |
| Grok Imagine 1 Quality | 1K، 2K | — | تا ۳ تصویر |
| Grok Imagine 1 | 1K، 2K | — | تا ۳ تصویر |
نکتهی دوم: برای چاپ، عبارت «۴K» بهتنهایی هیچ چیزی را تضمین نمیکند. کیفیت چاپ از سه چیز به دست میآید — ابعاد فیزیکی چاپ، تعداد پیکسل تصویر، و وضوح موردنیاز آن چاپ. اول اندازهی چاپ را مشخص کن، بعد ببین ابعاد خروجی کافی است یا نه.
پوستر و تایپوگرافیمتن داخل تصویر با کدام مدل؟
نوشتن متن برای مدلهای تصویر از کشیدن اشیا سختتر است، و متن فارسی بهدلیل حروف چسبان از انگلیسی هم سختتر. سه مدل در نگارسا در این کار از بقیه جلوترند: نانو بنانا پرو برای متن طولانی و چیدمان اطلاعاتی، GPT Image 2.5 Sunburst برای متن ریز و شلوغ، و FLUX.2 Flex اگر در خانوادهی FLUX میمانی.
- ✓متن دقیق را داخل گیومه بنویس و جای آن را در قاب مشخص کن: «در بالای پوستر دقیقاً عبارت …».
- ✓صریح بگو هیچ متن دیگری در تصویر ساخته نشود.
- ✓متن را کوتاه نگه دار؛ یک تیتر و یک زیرتیتر، نه یک پاراگراف.
- ×شماره تلفن، قیمت، آدرس و متن حقوقی را به مدل نسپار. تصویر و چیدمان را با مدل بساز و این متنها را بعداً در ابزار طراحی روی تصویر بگذار.

ویرایشادیت: کدام مدل چه چیزی را نگه میدارد
برای ادیت، پرامپت باید دو بخش روشن داشته باشد: چه چیزی عوض شود و چه چیزهایی دقیقاً ثابت بمانند. بخش دوم را بیشتر کاربران جا میاندازند و نتیجهاش این است که همراه با رنگ کت، چهره و نور هم کمی جابهجا میشود.
یک تفاوت فنی مهم هم هست: فقط خانوادهی GPT Image ماسک میپذیرد — یعنی میتوانی روی خود عکس علامت بزنی که کدام بخش اجازهی تغییر دارد و بقیه دستنخورده برمیگردد. روی مدلهای گوگل، FLUX و Grok، ادیت موضعی را فقط میشود توصیف کرد، نه علامت زد.
فقط پسزمینه را به یک استودیوی سادهی کرمرنگ تغییر بده. چهره، مدل مو، حالت بدن، لباس، تناسب اندام، زاویه دوربین، برش قاب و جهت نور دقیقاً بدون تغییر بماند.
تصویر مرجعچند عکس مرجع و حفظ چهره
نگه داشتن یک چهره یا یک محصول در چند تصویر، با متن تنها ممکن نیست؛ باید عکس مرجع بدهی. سقف تعداد مرجعها از مدلی به مدل دیگر فرق دارد و در جدول بالا آمده — از سه عکس در نسل اول Grok تا شانزده عکس در خانوادهی GPT Image.
مهمتر از تعداد، این است که نقش هر عکس را در پرامپت بنویسی. فرستادن چهار عکس و گفتن «اینها را ترکیب کن» تقریباً هیچوقت نتیجهی درستی نمیدهد؛ این میدهد:
تصویر ۱ = چهره و هویت شخصیت تصویر ۲ = لباس تصویر ۳ = سبک نورپردازی تصویر ۴ = محیط و لوکیشن یک تصویر تازه بساز که چهرهی تصویر ۱ را حفظ کند، لباس تصویر ۲ را پوشیده باشد، با نورپردازی تصویر ۳ و در محیط تصویر ۴.

هزینهفهرست مدلها، از ارزان به گران
قیمت هر تصویر پیش از ساختن مشخص است و به مدل، ابعاد و درجهی کیفیت بستگی دارد. فهرست زیر ارزانترین و گرانترین تصویری را که هر مدل میسازد نشان میدهد، به اعتبار، از ارزان به گران. ارزانترین تصویری که امروز میشود ساخت ۱۰ اعتبار است.
هزینهی هر تصویر درست به همان اندازه که ساختهای از موجودی کم میشود؛ نه اشتراک ماهانه، نه تمدید خودکار. مدلهایی که «فعلاً غیرفعال» شدهاند در استودیو نمایش داده نمیشوند.
دو قانوندو قانونی که پول را هدر نمیدهند
کیفیت، مشکلِ پرامپت را حل نمیکند
اگر ترکیببندی، زاویه، لباس یا تعداد اشیا اشتباه است، بردن کیفیت از «پایین» به «بالا» یا از 1K به 4K فقط نسخهی باکیفیتتری از همان ایدهی اشتباه میسازد. اول پرامپت را درست کن، بعد رزولوشن را.
با هر ادیت فقط یک مشکل را حل کن
اگر چهره درست است ولی پسزمینه و لباس مشکل دارند، اول پسزمینه را اصلاح کن و بعد لباس. این کار احتمال جابهجا شدن چهره و ترکیببندی را کم میکند.
اگر میخواهی خودِ پرامپت را بهتر بنویسی، آموزش کامل پرامپتنویسی برای ساخت تصویر با هوش مصنوعی شش لایهی یک پرامپت خوب را جدا جدا توضیح میدهد، و کتابخانهی پرامپت فارسی صدها پرامپت آماده دارد که میتوانی همانطور که هستند به کار ببری.
پرسش و پاسخپرسشهای پرتکرار
بهترین مدل ساخت عکس با هوش مصنوعی کدام است؟
بهترین مدل، مدلِ مرحلهی کار توست نه گرانترین مدل فهرست. برای ایدهپردازی نانو بنانا ۲ لایت یا FLUX.2 Klein، برای کار روزمره نانو بنانا ۲، برای ادیت دقیق و خروجی نهایی GPT Image 2.5، و برای پوستر و متن نانو بنانا پرو. اگر قرار باشد فقط یکی پیشنهاد شود، نانو بنانا ۲ متعادلترین انتخاب است.
«۴K» در همهی مدلها یک معنی دارد؟
نه. نانو بنانا ۲ و پرو خروجی ۴K دارند، خانوادهی FLUX.2 تا حدود چهار مگاپیکسل میسازد و اصلاً ۴K ندارد، و Grok Imagine حداکثر ۲K میدهد. برای همین در نگارسا کنار هر مدل دقیقاً همان ابعادی نوشته میشود که آن مدل واقعاً میسازد.
برای ادیت یک عکس موجود کدام مدل بهتر است؟
مدلهای GPT Image 2.5، چون تنها مدلهایی هستند که ماسک میپذیرند: میتوانی روی خود عکس مشخص کنی کدام بخش اجازهی تغییر دارد. اگر ماسک لازم نداری، نانو بنانا ۲ و FLUX.1 Kontext هم ادیتهای موضعی خوبی میدهند.
برای نوشتن متن داخل تصویر کدام مدل را انتخاب کنم؟
نانو بنانا پرو برای متن طولانی، چندزبانه و چیدمان اطلاعاتی مثل پوستر و منو؛ GPT Image 2.5 برای متن ریز و ادیت متن روی عکس موجود. متن دقیق را داخل گیومه بنویس و صریح بگو هیچ متن دیگری ساخته نشود. برای شماره تلفن، قیمت و آدرس بهتر است تصویر را بدون آن متن بسازی و نوشته را بعداً اضافه کنی.
کدام مدل پسزمینهی شفاف میسازد؟
فقط خانوادهی GPT Image. خروجی هم باید PNG یا WebP باشد؛ JPEG شفافیت را نگه نمیدارد.
گرانترین مدل بهترین نتیجه را میدهد؟
نه لزوماً. مدل گران در مرحلهی اشتباه فقط هزینه را بالا میبرد. روش حرفهای این است که ایده را با مدل ارزان پیدا کنی و فقط همان یک تصویری را که واقعاً منتشر میشود با مدل گران بسازی.
پرامپت را فارسی بنویسم یا انگلیسی؟
در نگارسا فارسی بنویس. پرامپت فارسی پیش از ارسال به مدل به یک پرامپت انگلیسیِ عکاسانه بازنویسی میشود، پس لازم نیست انگلیسی بلد باشی. چیزی که اهمیت دارد دقت است، نه زبان.
حالا همین را امتحان کن
یک حساب تازه با اعتبار رایگان باز میشود. با یک مدل سبک چند ایده بساز، یکی را انتخاب کن و همان را با مدل نهایی بگیر.
رایگان شروع کن