نانو بنانا (Nano Banana) چیست؟ مدل تصویرسازی گوگل
نانو بنانا چیست، نسخههای Pro و ۲ چه فرقی دارند، هر تصویر چقدر هزینه دارد و چطور از ایران به ساخت و ویرایش عکس با هوش مصنوعی برسی.

نانو بنانا (Nano Banana) اسم عجیبی برای یه محصول جدیه: خانوادهٔ مدلهای ساخت و ویرایش تصویر گوگل که زیر چتر جمنای کار میکنن. اگه اسمش رو جایی شنیدی و نفهمیدی دقیقاً چیه، جواب کوتاه اینه: نانو بنانا همون چیزیه که وقتی از جمنای میخوای یه عکس بسازه یا یه عکس موجود رو ویرایش کنه، پشت صحنه کار میکنه.
این مقاله میگه نانو بنانا چیه، نسخههاش چه فرقی دارن، هر تصویر چقدر خرج برمیداره، و مهمتر از همه برای خوانندهٔ ایرانی: از ایران چطور میشه بهش رسید.
چرا اسمش نانو بنانا است؟
اسم از یه کدنام داخلی اومده. گوگل موقع تست مدلهاش اسمهای بیربط و بامزه میذاره تا لو نره کدوم تیم پشتشه، و «Nano Banana» یکی از همونها بود. مدل که عمومی شد، اسم موند و جامعهٔ کاربرها بیشتر با همین میشناسنش تا اسم رسمیاش.
توی فارسی هر دو شکل نوشتار رایجه: «نانو بنانا» و «nano banana». اگه دنبال آموزش میگردی، هر دو رو امتحان کن.
خانوادهٔ نانو بنانا
نانو بنانا یه مدل تکی نیست، یه خانوادهست و اسمها گیجکنندهان:
نانو بنانا Pro
پرچمدار خانواده، ساختهشده روی موتور Gemini 3 Pro. یعنی مدل موقع ساخت تصویر از سیستم استدلال جمنای برای فهم پرامپت استفاده میکنه. نتیجهاش اینه که ترکیببندیهای پیچیده، رندر متن داخل تصویر و سبکهای خاص رو بهتر از بقیه در میاره. تا رزولوشن ۴K و ورودی چند تصویر مرجع رو پشتیبانی میکنه.
نانو بنانا ۲
نسل جدیدتر، روی موتور Flash. ادعای گوگل اینه که کیفیت نزدیک به Pro رو با سرعت خیلی بیشتر میده. برای وقتی خوبه که میخوای سریع چند بار پشتسرهم ویرایش کنی و منتظر نمونی.
نانو بنانا ۲ Lite
سبکترین و ارزانترین عضو خانواده. برای حجم بالا و کارهای انبوه ساخته شده، نه برای بهترین کیفیت ممکن.
قیمتها تقریبیان و گوگل مرتب تغییرشون میده، ولی نسبتها معمولاً ثابت میمونه:
| نسخه | هزینهٔ تقریبی هر تصویر |
|---|---|
| نسخهٔ پایه | حدود ۰.۰۳۹ دلار |
| نانو بنانا ۲ | حدود ۰.۰۶۷ دلار |
| Pro (۱K و ۲K) | حدود ۰.۱۳ دلار |
| Pro (۴K) | حدود ۰.۲۴ دلار |
نانو بنانا واقعاً توی چی خوبه؟
ویرایش عکس موجود، نه فقط ساختن از صفر. این نقطهٔ قوت اصلیشه و چیزیه که خیلیها اشتباه میفهمن. میتونی یه عکس بدی و با زبان معمولی بگی چی عوض بشه: «پسزمینه رو آبی کن» ← «یه درخت سمت چپ اضافه کن» ← «نور رو طلاییتر کن». هر دور روی نتیجهٔ قبلی سوار میشه.
رندر متن داخل تصویر. ضعف تاریخی مدلهای تصویرسازی نوشتن متن درست بود؛ اسم برند و حروف معمولاً بههم میریخت. Pro توی این کار از اکثر رقبا بهتره.
ترکیب چند تصویر مرجع. میتونی سبک یک تصویر و محتوای تصویر دیگه رو بدی و بخوای ترکیبشون کنه، که برای ثابت نگهداشتن چهرهٔ یک شخصیت در چند تصویر خیلی بهدرد میخوره.
فارسی چطوره؟
اینجا باید صادق بود. نانو بنانا میتونه متن فارسی داخل تصویر بذاره، ولی کیفیتش ناهمگونه:
- برای یک خط کوتاه مثل عنوان پوستر، معمولاً قابل قبوله.
- برای متن فارسی طولانی، حروف بههم میچسبه یا شکل نامتصل میگیره.
- برای خط نستعلیق و خوشنویسی، هنوز نتیجهٔ قابل اتکایی نمیده.
پرامپت نوشتن به فارسی کار میکنه، ولی تجربهٔ اکثر کاربرها اینه که پرامپت انگلیسی خروجی دقیقتری میده. یه راه میانه: توصیف صحنه رو انگلیسی بنویس و فقط متنی که باید داخل تصویر بیاد رو داخل گیومه فارسی بذار. برای عمیقتر شدن، راهنمای پرامپتنویسی تصویر رو بخون.
دسترسی از ایران
اینجا همون دیواریست که هر ابزار تصویرسازی خارجی بهش میخوره. نانو بنانا از طریق اپ جمنای، Google AI Studio و Gemini API در دسترسه و هر سه مسیر از ایران مستقیم باز نمیشن. دو مانع جدا وجود داره:
۱. آیپی. سرویسهای گوگل روی آیپی ایران بستهان. ۲. پرداخت. حتی اگه از مانع اول رد بشی، برای استفادهٔ جدی به کارت اعتباری بینالمللی نیاز داری که برای بیشتر کاربرهای ایرانی در دسترس نیست.
مانع دوم معمولاً سختتر از اولیه و کسی زیاد دربارهٔش حرف نمیزنه. چرا مدلهای جهانی از ایران باز نمیشن و خرید اشتراک هوش مصنوعی با پرداخت تومانی هر دو رو باز کردیم.
اگه فقط میخوای عکس بسازی، چه کار کنی؟
بستگی داره چی میخوای:
- کنترل کامل و رایگان، روی سیستم خودت: استیبل دیفیوژن هنوز بهترین گزینهست، به شرطی که کارت گرافیک مناسب داشته باشی.
- زیبایی هنری: میدجرنی.
- ویدیو بهجای عکس: Veo و پیکا.
- بدون دردسر آیپی و کارت خارجی: یه دستیار فارسی که خودش مسیر مدلها رو مدیریت کنه.
آیراچت همین کار رو میکنه: داخل خود چت فارسی میتونی بخوای عکس بسازه یا عکسی که فرستادی رو ویرایش کنه، بدون فیلترشکن و با پرداخت تومانی. لازم نیست بدونی پشت صحنه کدوم مدل داره کار میکنه.
جمعبندی
نانو بنانا اسم خانوادهٔ مدلهای تصویری گوگله، نه یک مدل. قویترین کاربردش ویرایش گفتوگویی عکس موجود و نوشتن متن درست داخل تصویره. فارسیاش هنوز قابل اتکا نیست و دسترسی مستقیم از ایران هم بهخاطر آیپی و هم پرداخت عملاً بستهست.
همچنین بخوان
ادامهٔ مسیر
همهٔ مقالهها ←
استیبل دیفیوژن (Stable Diffusion) چیست؟ راهنمای فارسی
مدل متنباز ساخت تصویر: چطور روی سیستم خودت اجرایش کنی، تفاوت نسخهها، و چرا هنوز برای سفارشیسازی بهترین گزینه است.

Veo گوگل، راهنمای ویدیو
گوگل توی مسابقهٔ ویدیوی هوش مصنوعی دیر وارد شد، ولی وقتی Veo 2 رو در اواخر ۲۰۲۴ معرفی کرد، خیلیها رو غافلگیر کرد.

تولید تصویر با هوش مصنوعی چیست
تولید تصویر با هوش مصنوعی یکی از مفاهیم پایهایه که اگه میخوای با تصویر و ویدیو جدی کار کنی، باید قبل از هر چیز این رو دقیق بفهمی.

AI برای موسیقی، Suno و Udio
تصور کن یه پرامپت متنی بنویسی، مثلاً «یه قطعه پاپ فارسی با گیتار آکوستیک، حال و هوای شب تابستانی، صدای زنانه»، و ۳۰ ثانیه بعد یه آهنگ کامل با صدای خواننده…
بیشتر در «تصویر و ویدیو»
- Midjourney، راهنمای کامل
- DALL-E 3، راهنمای عمیق
- Flux از Black Forest Labs
- Sora OpenAI، راهنمای ویدیو
- Kling، تولید ویدیو با AI
- Runway، استودیوی ویدیویی AI
- Higgsfield، کنترل دوربین در ویدیوی AI
- هایلو (Hailuo) مینیمکس؛ ساخت ویدیو با هوش مصنوعی
- پیکا (Pika)؛ ساخت و ویرایش ویدیو با هوش مصنوعی
- Leonardo و Ideogram
- ControlNet چیست؟ راهنمای فارسی
- Lip sync و face swap
- پرامپتنویسی برای تولید تصویر
- تدوین ویدیو با هوش مصنوعی؛ ابزارها و کاربرد واقعی
- اخلاق در deepfake