۷.۵۶ سنت؛ این قیمت جدید یک تصویر ۴کی است که پس از عرضه مدل Nano Banana 2.1 در ۶ اکتبر ۲۰۲۶، از ۱۵.۱۰ سنت به این رقم رسید. این اقدام گوگل عملاً کف قیمتی تولید تصاویر با رزولوشن بالا در صنعت هوش مصنوعی را جابهجا کرد و استانداردهای اقتصادی این بازار را بازتعریف نمود. این رویکرد در راستای استراتژی جدید گوگل برای مهار هزینههای محاسباتی است تا دسترسی به مدلهای بهینه را گسترش دهد.
این بهروزرسانی در حالی رخ میدهد که گوگل در حال بهینهسازی اکوسیستم چندوجهی (Multimodal) — مدلی که مثل ما با چند حس دنیا را میخواند و همزمان متن، عکس و صدا را میفهمد — است. همانطور که در تحلیل قبلی ما دربارهی بازتعریف ضبط صدا برای سختافزارهای هوش مصنوعی توسط گوگل و اپل اشاره کردیم، تمرکز این شرکت اکنون روی بهرهوری اقتصادی خروجیهاست. برای کاربران تجاری، این تغییر یعنی داراییهای بصری باکیفیت از یک هزینه لوکس به یک کالای ارزان و در دسترس تبدیل شدهاند.
تکامل مدل و جایگاه بازار
به گزارش وبسایت the-decoder.com، مدل Nano Banana 2.1 جایگزین نسخه فوریه ۲۰۲۶ شده و از معماری Gemini 3.6 Flash استفاده میکند. گوگل مدعی است این نسخه در تمامی بخشها نسبت به مدلهای قبلی پیشرفت کرده است و عملکردی جامعتر ارائه میدهد. این رقابت در بازار مدلهای بصری شدت یافته است، بهطوری که پیش از این مدل Qwen-Image-2.1 علیبابا توانسته بود در برخی شاخصها مدلهای بسته را به چالش بکشد.
در حالی که Nano Banana Pro همچنان گزینه سطح اول و پیشرفتهترین انتخاب است، اما بر پایه مدل قدیمیتر Pro 3.1 کار میکند. در مقابل، نسخه ۲.۱ با بهرهگیری از معماری جدیدتر Flash، به عنوان یک همتای بهینهتر و سریعتر برای مدل Pro عمل میکند. انتظار میرود جهش بعدی و چشمگیر در کیفیت بصری با مدل معرفیشدهی Gemini 4 Argon Pro رخ دهد.
مشخصات فنی و ساختار قیمتگذاری
مدل ۲.۱ با سرعت لایه Flash اجرا میشود و از رزولوشنهای 1K، 2K و 4K پشتیبانی میکند. همچنین برای بهبود دقت و کیفیت خروجیها، این مدل مستقیماً به جستوجوی گوگل متصل است تا اطلاعات بهروزتری را در تصاویر منعکس کند.
- کاهش هزینه: قیمتها تقریباً نصف شدهاند. تصاویر 1K از ۶.۷۰ به ۳.۳۶ سنت و تصاویر 4K از ۱۵.۱۰ به ۷.۵۶ سنت رسیدند. برای مقایسه، هر تصویر 1K در نسخه Pro حدود ۱۳.۴۰ سنت هزینه دارد که تفاوت قیمتی چشمگیری را نشان میدهد.
- ثبات بصری: این مدل میتواند تا ۱۴ تصویر مرجع را به طور همزمان پردازش کند. این قابلیت اجازه میدهد تا چهار شخصیت و ۱۰ شیء در طول نوبتهای مختلف گفتگو و تولید تصویر، کاملاً ثابت و بدون تغییر باقی بمانند.
- قابلیتها: بهبود رندر متن (نوشتار دقیقتر در عکس)، تولید پانوراماهای عریض و افزایش دقت در ساخت اینفوگرافیکها از ویژگیهای جدید است. همچنین سه سطح تفکر (کم، متوسط و زیاد) تعبیه شده است که مستقیماً بر کیفیت نهایی خروجی اثر میگذارد.
- یکپارچگی: این مدل در Google AI Studio، Google Ads، اپلیکیشن Gemini، حالت AI Mode در جستوجوی گوگل، ابزارهای Flow by Google و Stitch by Google و همچنین پلتفرم Gemini Enterprise در حال عرضه است.

با این حال، طبق بررسیهای فنی، شکاف عملکردی همچنان پابرجاست. در تستهای عملی، Nano Banana Pro (که بر پایه Gemini 3.1 Pro است) همچنان رنگها و تناسبات طبیعیتری تولید میکند. برای مثال، مدل ۲.۱ در اجرای پرامپتهای پیچیده — مثل اسبی که سوار بر یک فضانورد است — گاهی در تشخیص مقیاس دچار خطا میشود و حیوانات بزرگ را شبیه پونی میکشد.

دادههای محک (Benchmark) نشان میدهد نسخه ۲.۱ در حالت «تفکر» (Thinking)، در برخی نقاط خاص از Pro پیشی میگیرد. این مدل در بخش «ثبات چند-شخصیتی» امتیاز ۱۱۰۶ ± ۱۴ را کسب کرد، در حالی که امتیاز Pro حدود ۱۰۱۱ ± ۱۰ بود. همچنین در «ویرایش چند-مرجعی» امتیاز ۱۰۶۶ ± ۲۲ را به دست آورد، در حالی که امتیاز Pro حدود ۹۸۹ ± ۱۲ بود. با این حال، نسخه Pro همچنان استاندارد طلایی برای واقعگرایی مطلق است.
این استراتژی قیمتی نشان میدهد گوگل مدل ۲.۱ را به عنوان «اسب بارکش» برای اتوماسیونهای سازمانی میبیند. با کاهش تقریباً ۵۰ درصدی هزینهها، گوگل تولید هزاران نسخه مختلف از تبلیغات یا اینفوگرافیکهای تکرار شونده را برای شرکتها، بدون نیاز به بودجههای کلان، ممکن کرده است.
برای کاربر نهایی، معامله ساده است: شما واقعگرایی مطلق مدل Pro را فدای سرعت بسیار بالا و کاهش شدید هزینه میکنید. این تغییر، تولید تصویر را از یک فرآیند خلاقانه و گزینشی به یک ابزار کاربردی، مقیاسپذیر و در دسترس تبدیل میکند.
کاربران باید سریعاً گردشکار خود را تغییر دهند، زیرا گوگل مدل قدیمی «gemini-3.1-flash-image» را در ۲۹ اکتبر ۲۰۲۶ به طور کامل متوقف میکند.
گام بعدی شما
- اگر از APIهای گوگل برای تولید محتوای انبوه استفاده میکنید، مدل را به نسخه ۲.۱ ارتقا دهید تا هزینههایتان نصف شود.
- برای پروژههایی که نیاز به ثبات شخصیت در چندین تصویر دارند، قابلیت پردازش ۱۴ تصویر مرجع را تست کنید.
- برای خروجیهای نهایی و تبلیغات چاپ شده، همچنان از نسخه Pro استفاده کنید تا دچار خطای مقیاس نشوید.
اما جهش واقعی در کیفیت بصری با مدل Gemini 4 Argon رخ خواهد کرد که گوگل آن را به عنوان گام بعدی در ارتقای کیفیت خام تصاویر معرفی کرده و جزئیات آن را در گزارشهای آینده بررسی میکنیم.




گفتگو