پرش به محتوای اصلی
پرش به محتوای مقاله

Artificial Analysis: مدل Gemini 3.6 Flash هوشمندتر از نسخه Pro شد

·۱۷ مرداد ۱۴۰۵۸ دقیقه مطالعه۱ بازدید
تصویر: مقایسه مدل‌های Gemini در ژوئیه ۲۰۲۶ - فلش ۳.۶، فلش‌لایت ۳.۵ یا پرو ۳.۱
تصویر: مقایسه مدل‌های Gemini در ژوئیه ۲۰۲۶ - فلش ۳.۶، فلش‌لایت ۳.۵ یا پرو ۳.۱
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

برتری عینی مدل رایگان (3.6 Flash) بر مدل پولی (3.1 Pro) در شاخص هوش؛ در حالی که پیشرفت اصلی مدل جدید نه در هوش، بلکه در کاهش ۱۷ درصدی مصرف توکن‌ها و افزایش چشمگیر سرعت است.

اگر امروز برای اشتراک گوگل پول پرداخت می‌کنید، احتمالاً برای مدلی هزینه می‌کنید که از نسخه رایگان ضعیف‌تر است. طبق داده‌های شاخص هوش Artificial Analysis، مدل Gemini 3.6 Flash نمره ۵۰ را کسب کرده، در حالی که نسخه اشتراکی Gemini 3.1 Pro Preview با نمره ۴۶ عقب مانده است. این تفاوت یک خطای آماری ساده یا اشتباه تایپی نیست؛ بلکه دو اندازه‌گیری مستقل است که منطق انتخاب مدل در اپلیکیشن Gemini را به‌کل به‌هم می‌زند.

این تغییر، اساساً منطق مدل‌سوئیچر (Model Switcher) در اپلیکیشن Gemini را می‌شکند. برای کاربرانی که ماهانه ۱۹.۹۹ دلار بابت اشتراک Google AI Pro می‌پردازند، برچسب «Pro» دیگر تضمین‌کننده هوش برتر نیست. در جولای ۲۰۲۶، انتخاب مدل Pro برای یک تسک حساس، یک روش اکتشافی (Heuristic) معیوب است. هزینه این خطا انتزاعی نیست: یا شما برای مدلی با هوش کمتر، اشتراکی گران‌تر می‌پردازید، یا در تسکی شکست می‌خورید که در واقع یک مدل توانمندتر برای حل آن وجود داشت.

همان‌طور که در تحلیل قبلی ما درباره‌ی مدیریت ادغام Gemini در گوگل ورک‌اسپیس اشاره کردیم، این به‌روزرسانی شکاف عمیقی را بین برندینگ گوگل و عملکرد واقعی مدل‌ها نشان می‌دهد. وضعیت فعلی اکوسیستم Gemini، وضعیتی از نسخه‌های پراکنده و تأخیر در عرضه مدل‌های پرچم‌دار است.

گسترش خانواده Flash

گوگل در ۲۱ جولای ۲۰۲۶، مدل Gemini 3.5 Flash را با Gemini 3.6 Flash جایگزین کرد. این معرفی از طریق یک پست وبلاگی انجام شد. به گزارش TechCrunch، این عرضه تقریباً بدون هیچ مراسم بزرگی رخ داد که نشان‌دهنده تلاش گوگل برای حفظ سهم بازار از طریق سرعت و قیمت‌گذاری است، در حالی که مدل پرچم‌دار اصلی با تأخیر مواجه شده است. در کنار این مدل، شرکت دو نسخه تخصصی دیگر را نیز منتشر کرد:

  • Gemini 3.5 Flash-Lite: مدلی که برای حجم انبوهی از پرس‌وجوهای ساده بهینه شده است؛ جایی که تنها اولویت‌ها هزینه و سرعت هستند، نه عمق تحلیل.
  • Gemini 3.5 Flash Cyber: یک مدل در مرحله آزمایشی بسته (Closed-pilot) که به‌طور خاص برای پژوهش‌های مربوط به آسیب‌پذیری در کدها طراحی شده و تنها در اختیار دولت‌ها و شرکای منتخب قرار دارد.

بر اساس داده‌های رسمی گوگل، مدل 3.6 Flash به‌طور قابل‌توجهی بهینه‌تر شده است. این مدل برای انجام کارهای مشابه، ۱۷٪ توکن‌های خروجی کمتری نسبت به نسل قبلی خود مصرف می‌کند. همین بهره‌وری باعث شد قیمت توکن‌های خروجی از ۹ دلار به ۷.۵۰ دلار به ازای هر میلیون توکن کاهش یابد، در حالی که قیمت توکن‌های ورودی روی ۱.۵۰ دلار به ازای هر میلیون توکن ثابت مانده است. این استراتژی کاهش هزینه‌ها در راستای رقابت با مدل‌های کوچک‌تر است، مشابه آنچه در مدل‌های قیمت‌گذاری جدید خانواده Nano Banana گوگل مشاهده شد. در حال حاضر، جست‌وجوی رایج «gemini 3.5 vs 3.1 pro» منسوخ شده است؛ مقایسه درست، تقابل 3.6 Flash در برابر 3.1 Pro راکد است.

تغییردهنده Gemini در ژوئیه ۲۰۲۶: ۳.۶ Flash، ۳.۵ Flash-Lite یا ۳.۱ Pro

تناقض نسخه Pro

سردرگمی کاربران از یک عدم تطابق در نام‌گذاری در اپلیکیشن Gemini ناشی می‌شود. گزینه «Pro» در حال حاضر به Gemini 3.1 Pro اشاره دارد که مدلی از نسل قبلی است. در واقع، مدل Gemini 3.5 Pro هنوز برای عموم منتشر نشده است.

تولسی دوشی، مدیر ارشد مدیریت محصول در Google DeepMind، اعلام کرد که Gemini 3.5 Pro در حال حاضر توسط شرکا تست می‌شود و «به محض آماده شدن» در دسترس خواهد بود. با این حال، گزارش‌های Bloomberg که توسط TechCrunch نقل شده، به یک جدول زمانی دشوارتر اشاره دارد. این منابع مدعی‌اند که مدل مذکور در رسیدن به اهداف داخلی برای استدلال‌های پیچیده (Complex Reasoning) و کدنویسی شکست خورده است.

تک‌کرانچ این وضعیت را به جای یک بهینه‌سازی روتین، به عنوان شکست در برنامه اصلی توصیف می‌کند. تفاوت بین روایت رسمی «تست با شرکا» و روایت «عدم دستیابی به برنامه‌های داخلی»، تفاوت بین جمله‌ی «لطفاً منتظر بمانید» و «استراتژی را بازنگری کنید» است. در حالی که 3.5 Pro در حلقه تست‌های شرکا گیر کرده است، گزینه Pro در اپلیکیشن شما همان 3.1 Pro است که از نظر شاخص هوش ترکیبی، به‌طور عینی ضعیف‌تر از مدلی است که رسماً یک پله پایین‌تر از آن جایگذاری شده است.

سرعت در برابر هوش

با وجود برتری 3.6 Flash نسبت به 3.1 Pro، این مدل لزوماً «هوشمندتر» از نسخه قبلی خود (3.5 Flash) نشده است. Artificial Analysis اشاره می‌کند که هر دو مدل 3.5 و 3.6 Flash نمره ۵۰ را در شاخص هوش کسب کرده‌اند و صراحتاً می‌گوید: «Gemini 3.6 Flash از نظر هوش نسبت به 3.5 Flash پیشرفتی نداشته است».

بهره اصلی در اینجا «سرعت» است. طبق مقاله‌ای از Artificial Analysis درباره دو برابر شدن سرعت‌ها، زمان تکمیل کارهای معمول در مدل Flash از ۲.۷ دقیقه به ۱.۳ دقیقه و در Flash-Lite از ۱.۰ دقیقه به ۰.۶ دقیقه کاهش یافته است. برخی تحلیلگران تکنولوژی، مانند tech-insider.org، ادعای «افزایش ۱۲ واحدی هوش» را مطرح کرده‌اند، اما این یک تفسیر بازاریابی است که با اندازه‌گیری‌های مستقل در تضاد است.

تصویر: مقایسه مدل‌های Gemini در ژوئیه ۲۰۲۶ - فلش ۳.۶، فلش‌لایت ۳.۵ یا پرو ۳.۱

این جهش سرعت در کدنویسی و گردش‌های کاری عامل‌محور (Agentic) بیشترین اثر را دارد. GitHub مدل 3.6 Flash را در Copilot برای کاربران Pro, Pro+, Max, Business و Enterprise ادغام کرده است. این رویکرد بهینه‌سازی برای عامل‌های کدنویسی، یادآور رقابت شدیدی است که اخیراً با کاهش ۵۰ درصدی هزینه‌های اجرای عامل‌های Grok 4.5 شدت گرفته است. این شرکت گزارش داده که نرخ تکمیل تسک‌ها افزایش و بهره‌وری توکن‌ها در مقایسه با 3.5 Flash بهبود یافته است. اگرچه در لیست تغییرات (Changelog) گیت‌هاب درصد دقیقی از بهبود ذکر نشده، اما همین که این مدل جایگزین مدل پیش‌فرض شده، ثابت می‌کند که در کدنویسی تکرارشونده — جایی که سرعت تکرار مهم‌تر از عمق یک پاسخ واحد است — یک مدل سریع‌تر و ارزان‌تر پیروز می‌شود.

محدودیت‌های فنی و مرزها

کاربران باید از چندین محدودیت که مستند نشده‌اند یا توسط شخص ثالث تأیید شده‌اند آگاه باشند، زیرا گوگل هیچ جدول رسمی جامع از ویژگی‌ها ارائه نکرده است:

  • پنجره زمینه (Context Window): مدل 3.6 Flash پنجره‌ای در حدود ۱ میلیون توکن را حفظ کرده است. به‌طور دقیق‌تر، در جداول خلاصه شخص ثالث عدد ۱,۰۴۸,۵۷۶ توکن ذکر شده، هرچند گوگل در پست رسمی خود از این رقم چشم‌پوشی کرد.
  • تاریخ قطع دانش (Knowledge Cutoff): طبق گزارش 9to5Google، این تاریخ از ژانویه ۲۰۲۵ به مارس ۲۰۲۶ منتقل شده است.
  • دسترسی API: به گزارش وبلاگ Apiyi، از آوریل ۲۰۲۶ مدل‌های سطح Pro از لایه رایگان API حذف شده‌اند. کاربران باید محدودیت‌های RPM (درخواست در دقیقه) را به عنوان راهنما در نظر بگیرند، نه تضمین.
  • ورودی چندوجهی (Multimodal): مدل‌های فعلی Flash از ورودی‌های متن، تصویر، ویدیو، صدا و PDF با خروجی متنی پشتیبانی می‌کنند. با این حال، هیچ گزینه‌ای در مدل‌سوئیچر وجود ندارد که آن را به یک تولیدکننده تصویر تبدیل کند؛ تولید تصویر همچنان یک خط محصول جداگانه است.

برای کاربران اپلیکیشن، اشتراک ۱۹.۹۹ دلاری محدودیت روزانه ثابتی ارائه نمی‌دهد. در عوض، 9to5Google از یک «بودجه محاسباتی» (Compute Budget) صحبت می‌کند که هر ۵ ساعت بازنشانی می‌شود و یک سقف هفتگی دارد. یک مشاهده از نوامبر ۲۰۲۵ که توسط PhoneArena تأیید شد، به مکانیزم «بازگشت خاموش» (Silent Rollback) اشاره دارد: وقتی بودجه Pro تمام شود، اپلیکیشن بدون هشدار به کاربر، پاسخ‌ها را به مدل ضعیف‌تر Flash تغییر می‌دهد.

راهنمای انتخاب کاربردی

انتخاب مدل مناسب اکنون به مورد استفاده خاص بستگی دارد، نه برچسب قیمت:

  • برای کدنویسی و عامل‌ها: از 3.6 Flash استفاده کنید. این مدل در حال حاضر پیش‌فرض Copilot است و بهترین تعادل بین سرعت و هوش را ارائه می‌دهد.
  • برای پردازش‌های انبوه: از 3.5 Flash-Lite استفاده کنید. با قیمت ۰.۳۰ دلار به ازای هر میلیون توکن ورودی و ۲.۵۰ دلار برای خروجی، این مدل در ورودی ۵ برابر و در خروجی ۳ برابر ارزان‌تر از 3.6 Flash است.
  • برای قدرت «حداکثری»: ابتدا شاخص هوش را بررسی کنید. از آنجایی که 3.1 Pro نمره کمتری نسبت به 3.6 Flash دارد، اشتراک پولی در حال حاضر یک «نام تجاری» را می‌خرد، نه یک پاسخ بهتر. تنها دلیل برای ماندن در حالت Pro این است که منتظر عرضه واقعی 3.5 Pro باشید.

منگ لی، بررسی‌کننده مستقل، هشدار می‌دهد که تجربه دنیای واقعی همچنان متناقض است. او عملکرد 3.6 Flash را به عنوان «داستانی از دو حد افراطی» توصیف می‌کند و معتقد است که نوع پرامپت‌ها بیشتر از نمرات بنچمارک ترکیبی اهمیت دارند. این تفاوت به این معناست که برای اسناد طولانی در زبان‌هایی مانند روسی، شاخص هوش ممکن است پیش‌بینی‌کننده دقیقی برای کیفیت نباشد، زیرا هیچ تست مستقل زبان روسی برای این سه مدل وجود ندارد.

اگر نیاز دارید این مدل‌ها را با مدل‌های دیگر مقایسه کنید بدون اینکه ادغام‌های خود را بازنویسی کنید، ابزارهایی مانند provod.ai به شما اجازه می‌دهند با تغییر ساده URL پایه و کلید API، ارائه‌دهنده را عوض کنید. این برای تیم‌هایی که نیاز به صورت‌حساب‌های پیش‌بینی‌پذیر به روبل دارند تا از تبدیل ارز و نیاز به کارت‌های خارجی اشتراک Google AI Pro اجتناب کنند، بسیار مفید است. Provod.ai پرداخت از طریق کارت‌های روسی، SBP یا فاکتورهای شرکتی برای اشخاص حقوقی را می‌پذیرد و نیاز به VPN یا حساب بانکی خارجی را از بین می‌برد.

منتظر عرضه نهایی Gemini 3.5 Pro باشید؛ این اولین تست واقعی خواهد بود که نشان می‌دهد آیا گوگل می‌تواند برتری هوش را در برابر سری Flash بازپس بگیرد یا خیر.

provod.ai — از ایده و متن تا تصویر، ویدیو و صدا

فرآیند تولید محتوای خود را بدون جابجایی بین ده‌ها سرویس بسازید: سناریوها، بصری‌ها، کلیپ‌ها، موسیقی و صدا همگی از یک حساب، API و موجودی تیمی استفاده می‌کنند. کاتالوگ شامل مدل‌های فعلی متن و رسانه است: GPT از OpenAI، Claude از Anthropic، Gemini از Google، Grok از xAI، DeepSeek، Qwen، GLM، Kimi و MiniMax؛ برای تصاویر — Nano Banana 2 Pro و GPT Image؛ برای ویدیو — آخرین نسخه‌های Seedance، Kling، Veo و Google Omni. مدل‌های استدلال، جست‌وجو، اسناد، Embedding، موسیقی و صدا نیز در دسترس هستند. هر فرمت با قیمت پایه ارائه‌دهنده به صورت ۱:۱ پرداخت می‌شود؛ provod.ai پرداخت‌ها را بدون افزودن هیچ حاشیه سودی یکپارچه می‌کند.

تولید رسانه‌ای خود را در provod.ai راه‌اندازی کنید: فرم ثبت‌نام · قیمت مدل‌ها · حفاظت از داده‌ها طبق 152-FZ · صفحه اصلی provod.ai

چرا این موضوع مهم است؟

این اتفاق اعتبار برچسب Pro را در اکوسیستم گوگل تخریب می‌کند و نشان می‌دهد که مدل‌های کوچک و بهینه (SLM) اکنون می‌توانند در بسیاری از شاخص‌های هوش با مدل‌های بزرگ رقابت کنند. این تغییر، استراتژی پرداخت کاربران را از «خرید هوشمندترین مدل» به «خرید سریع‌ترین و ارزان‌ترین مدل» تغییر می‌دهد.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و پرداخت‌های ارزی، توسعه‌دهندگان ایرانی می‌توانند از واسطه‌هایی مانند provod.ai برای دسترسی به مدل 3.6 Flash با هزینه کمتر و بدون نیاز به کارت خارجی استفاده کنند.

·نگاه ما
تحریریه دات‌هوش

گوگل در حال حاضر در تله‌ی «برندینگ سریع» افتاده است و برای پر کردن خلأ مدل پرچم‌دار، مدل‌های بهینه را با نام‌های گمراه‌کننده عرضه می‌کند. این وضعیت نشان می‌دهد که در رقابت فعلی، سرعت استنتاج و کاهش هزینه به اولویتی بالاتر از افزایش مطلق هوش تبدیل شده است. در واقع، مدل‌های «Flash» در حال تبدیل شدن به استاندارد واقعی صنعت هستند و مدل‌های «Pro» تنها برای تسک‌های بسیار خاص و نادر کاربرد خواهند داشت.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.