پرش به محتوای اصلی
پرش به محتوای مقاله

مدل‌های جدید گوگل و xAI چگونه هزینه پردازش‌های حجیم را پایین می‌آورند؟

·۲۵ مرداد ۱۴۰۵۳ دقیقه مطالعه۱ بازدید
مدل‌های جدید گوگل، دیپ‌سیک و xAI این هفته — گزارش قیمت مدل‌های زبانی بزرگ
مدل‌های جدید گوگل، دیپ‌سیک و xAI این هفته — گزارش قیمت مدل‌های زبانی بزرگ
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

معرفی درگاه Batch برای Gemini 3.7 Flash؛ این اولین گام جدی گوگل برای تفکیک قیمت استنتاج آنی از پردازش‌های انبوه آفلاین در مدل‌های سری Flash است.

اگر همین حالا برای پردازش حجم عظیمی از اسناد هزینه می‌پردازید، ابزارهای جدید گوگل می‌تواند صورت‌حساب ماهانه شما را به‌شدت کاهش دهد. چهار نسخهٔ جدید از مدل‌های گوگل (Google)، دیپ‌سیک (DeepSeek) و xAI در هفتهٔ ۱۴ اوت ۲۰۲۶ وارد بازار شدند.

این به‌روزرسانی‌ها در زمانی رخ می‌دهند که کسب‌وکارها از محیط‌های آزمایشی به سمت سیستم‌های عملیاتی حرکت می‌کنند. همان‌طور که در تحلیل قبلی ما درباره‌ی نقش طرح‌واره‌های JSON در ایجاد حفاظ‌های امنیتی برای چت‌بات‌ها اشاره کردیم، تمرکز صنعت اکنون از «امکان‌پذیری» به «بهینه‌سازی هزینه» تغییر کرده است. در این مسیر، مدل زبانی بزرگ (LLM) — مثل کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن کتاب‌ها جواب می‌دهد — باید بتواند بدون کاهش کیفیت، ارزان‌تر عمل کند.

مدل‌های جدید گوگل، دیپ‌سیک و xAI این هفته — گزارش قیمت مدل‌های زبانی بزرگ

طبق گزارش وب‌سایت dev.to، مهم‌ترین تغییرات این هفته شامل موارد زیر است:

  • Gemini 3.7 Flash: گوگل در ۱۴ اوت ۲۰۲۶ علاوه بر نسخه استاندارد، مدل gemini-3.7-flash:batch را معرفی کرد. این درگاه مخصوص کارهای آفلاین مثل طبقه‌بندی انبوه داده‌هاست و در برابر تأخیر بیشتر، تخفیف قیمتی ارائه می‌دهد.
  • DeepSeek v4 Pro 0813: این نسخه که در ۱۳ اوت مشاهده شد، یک نقطهٔ بازرسی (Checkpoint) به‌روز شده از معماری v4 Pro است و مدل کاملاً جدیدی محسوب نمی‌شود.
  • Grok 4.6: شرکت xAI در ۱۳ اوت این نسخه را با تمرکز بر بهبود استدلال و پیروی دقیق‌تر از دستورات منتشر کرد.

برای یک مدیر کسب‌وکار، این یعنی پیش‌بینی‌های هزینه‌ای فعلی شما همچنان معتبر است چون قیمت‌ها تغییر نکرده‌اند. اما معرفی قابلیت Batch در جمینای، اهرمی جدید برای حذف هزینه‌های اضافی در کارهایی است که نیاز به پاسخ آنی ندارند. در این میان، استنتاج (Inference) — لحظه‌ای که مدل واقعاً جواب تولید می‌کند، شبیه خودِ آشپزی و نه دوره‌ی آموزش آشپز — در مدل‌های دیپ‌سیک همچنان ارزان‌ترین گزینه است. این رویکرد تهاجمی در قیمت‌گذاری، یادآور معرفی مدل DeepSeek V4 Flash بود که توانست با هزینه‌ای ۶۰٪ کمتر، عملکردی مشابه GPT-5.6 Luna ارائه دهد.

به باور تحلیلگران، دیپ‌سیک همچنان تهاجمی‌ترین استراتژی قیمت به عملکرد را دنبال می‌کند. به همین دلیل، هر به‌روزرسانی حتی کوچک در مدل‌های این شرکت باید دوباره محک بخورد تا مشخص شود آیا کیفیت در همان قیمت قبلی ارتقا یافته است یا خیر.

گام بعدی شما

  • اگر حجم بالایی از داده‌های غیرفوری دارید، درگاه Batch مدل جمینای را برای کاهش هزینه‌ها تست کنید.
  • مدل Grok 4.6 را در سناریوهای پیچیدهٔ استدلالی بسنجید تا تفاوت آن با نسخه قبلی را ارزیابی کنید.
  • بنچمارک‌های داخلی خود را روی نسخه 0813 دیپ‌سیک اجرا کنید تا تغییرات کیفیت را بسنجید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این به‌روزرسانی‌ها با تکیه بر اعتبار فنی گوگل و xAI، کفِ هزینه‌های عملیاتی برای پردازش انبوه داده را جابه‌جا می‌کنند. توسعه‌دهندگان اکنون می‌توانند بدون تغییر در بودجه، از مدل‌هایی با استدلال قوی‌تر یا هزینه‌ی استنتاج کمتر استفاده کنند.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌ها، دسترسی مستقیم توسعه‌دهندگان ایرانی به درگاه‌های جدید گوگل و xAI همچنان نیازمند زیرساخت‌های واسط است.

·نگاه ما
تحریریه دات‌هوش

ثبات قیمت‌ها در این موج به‌روزرسانی نشان می‌دهد که رقابت از «جنگ قیمت» به «جنگ بهره‌وری» تغییر مسیر داده است. گوگل با معرفی درگاه Batch، عملاً مدل‌های خود را برای مصرف صنعتی و پردازش‌های پس‌زمینه بهینه می‌کند تا سهم بازار شرکت‌های پردازش داده را بگیرد. این یعنی مدل‌های سریع و ارزان (Flash) دیگر فقط برای چت‌بات‌ها نیستند، بلکه قرار است موتور محرک اتوماسیون‌های حجیم شرکتی شوند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.