پرش به محتوای اصلی
پرش به محتوای مقاله

«سرعت، معیار جدید»؛ رویکرد مشترک گوگل و آنتروپیک در مدل‌های جدید

·۱۰ تیر ۱۴۰۵۲ دقیقه مطالعه
دو مدل کلود سونت ۵ و دیفیوژن جمینا که هوش مصنوعی را متحول می‌کنند
دو مدل کلود سونت ۵ و دیفیوژن جمینا که هوش مصنوعی را متحول می‌کنند
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر استراتژی از افزایش توان استدلالی به بهینه‌سازی تأخیر؛ اکنون سرعت تولید تصویر در لبه (On-device) به زیر یک ثانیه رسیده است.

اگر امروز برای استنتاج مدل‌های پیشرفته هزینه می‌دهید، سرعت پاسخ‌دهی در جریان تغییر است. در ۳۰ ژوئن ۲۰۲۶، شرکت آنتروپیک (Anthropic) مدل Claude Sonnet 5 را معرفی کرد؛ ابزاری که در کدنویسی و استدلال با GPT-5.5 Instant رقابت می‌کند اما هزینه‌های تأخیر را به‌شدت کاهش داده است.

این حرکت، مسیر رسیدن به عامل‌های خودکار را هموارتر می‌کند. مدل زبانی بزرگ (LLM) — مثل کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن کتاب‌ها جواب می‌دهد — اکنون باید بتواند در لحظه تصمیم بگیرد. همان‌طور که در تحلیل قبلی ما درباره‌ی سیستم‌های تولید ایمیل بدون کدنویسی اشاره کردیم، نیاز به سرعت در اجرای لحظه‌ای، اولویت کسب‌وکارهاست. اکنون صنعت از پرامپت‌های ایستا به سمت گردش‌های کاری عامل‌محور (Agentic) و چندمرحله‌ای حرکت می‌کند.

بر اساس گزارش وب‌سایت dev.to، مدل Claude Sonnet 5 جهش‌های فنی زیر را ثبت کرده است:

  • سرعت: پاسخ‌دهی در پرامپت‌های پیچیده ۳ برابر سریع‌تر از Sonnet 4.5 و ۱۰ برابر سریع‌تر از مدل‌های رده Opus است.
  • پنجره متنی: پنجره متنی (Context Window) — مثل میز کاری که جا برای چند ورق دارد، نه برای کل کتابخانه — در این مدل ۲۰۰ هزار توکن با نرخ بازیابی تقریباً کامل است.
  • دسترسی: این مدل از همین امروز از طریق API آنتروپیک، AWS و GCP در دسترس است.

در همین زمان، گوگل دیپ‌مایند (Google DeepMind) خانواده مدل‌های DiffusionGemma را منتشر کرد. این مدل‌ها از تکنیک تقطیر (Distillation) — شبیه به عصاره‌گیری از یک دستور پخت مفصل برای رسیدن به یک دستور سریع و ساده — استفاده می‌کنند تا کیفیت تصویر را حفظ کرده و سرعت تولید را ۴ برابر کنند.

مشخصات فنی DiffusionGemma به شرح زیر است:

  • نسخه 2B: بهینه برای دستگاه‌های لبه؛ تولید تصاویر ۵۱۲ در ۵۱۲ پیکسل در کمتر از ۱ ثانیه روی GPUهای معمولی.
  • نسخه 8B: تولید تصاویر با کیفیت ۱۰۲۴ در ۱۰۲۴ که با DALL·E 4 رقابت می‌کند.
  • لایسنس: هر دو مدل با مجوز Apache 2.0 در Hugging Face و Kaggle منتشر شده‌اند.

به گزارش منابع صنعتی، این عرضه دوجانبه نشان می‌دهد «مسابقه هوش» جای خود را به «مسابقه تأخیر» داده است. برای کاربر نهایی، این یعنی استنتاج (Inference) — لحظه‌ای که مدل واقعاً جواب تولید می‌کند، مثل خودِ آشپزی و نه دوره‌ی آموزش آشپز — دیگر حس یک درخواست کند را ندارد و شبیه نرم‌افزارهای آنی عمل می‌کند.

گام بعدی شما

  • توسعه‌دهندگان اپلیکیشن‌های موبایل باید مدل 2B DiffusionGemma را برای حذف نیاز به ابری‌سازی (Cloud) آزمایش کنند.
  • برای کاهش هزینه‌های عملیاتی عامل‌های هوشمند، جایگزینی Sonnet 4.5 با نسخه ۵ را در اولویت قرار دهید.
  • سرعت پاسخ‌دهی را در سناریوهای بلادرنگ (Real-time) بسنجید تا گلوگاه‌های تجربه کاربر را شناسایی کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این تحول با تکیه بر تخصص مهندسی گوگل در تقطیر مدل‌ها، هزینه و زمان استقرار AI را در دستگاه‌های کاربر نهایی به‌طور چشم‌گیر کاهش می‌دهد. اعتبار این رویکرد در سرعت پاسخ‌دهی است که پذیرش انبوه عامل‌های هوشمند را ممکن می‌سازد.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌ها، دسترسی مستقیم به Sonnet 5 دشوار است، اما انتشار مدلs DiffusionGemma با وزن‌های باز، فرصت بزرگی برای توسعه‌دهندگان ایرانی در زمینه تولید تصویر محلی و آفلاین ایجاد می‌کند.

·نگاه ما
تحریریه دات‌هوش

تمرکز بر کاهش تأخیر به جای افزایش پارامترها، نشان می‌دهد که مدل‌های لبه (Edge AI) دیگر حاشیه نیستند، بلکه مرکز استراتژی شرکت‌های بزرگ شده‌اند. وقتی سرعت استنتاج به زیر یک ثانیه می‌رسد، مرز بین «نرم‌افزار سنتی» و «هوش مصنوعی» از بین می‌رود و عامل‌های هوشمند از حالت چت‌بات به ابزارهای سیستم‌عاملی تبدیل می‌شوند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.