پرش به محتوای اصلی
پرش به محتوای مقاله

میزبانی عامل‌های هوش مصنوعی در گوگل کلاد با هزینه ۵.۷۰ دلار در ماه

·۱۰ مهر ۱۴۰۵۵ دقیقه مطالعه۱ بازدید
راهنما
نمونه‌های Cloud Run: میزبانی عامل هوش مصنوعی با اجرای مداوم
نمونه‌های Cloud Run: میزبانی عامل هوش مصنوعی با اجرای مداوم
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

معرفی Cloud Run instances به عنوان یک منبع Always-on که مشکل خوابیدن سرویس‌های بدون سرور را حل کرده و اجازه می‌دهد عامل‌های AI با حافظه پایدار و هزینه بسیار کم (۵.۷۰ دلار) اجرا شوند.

اگر قصد دارید یک عامل هوش مصنوعی بسازید که شب‌ها بیدار بماند و کارهای شما را مدیریت کند، دیگر نیازی به مدیریت سرورهای پیچیده ندارید. حالا می‌توانید یک عامل دائمی را تنها با هزینه ۵.۷۰ دلار در ماه روی زیرساخت گوگل استقرار دهید.

این امکان از طریق Cloud Run instances، نوع جدیدی از منابع در گوگل کلاد (Google Cloud)، فراهم شده است. طبق مستندات گوگل، این قابلیت به عامل‌ها اجازه می‌دهد در پس‌زمینه فعال بمانند؛ مثلاً هشدارها را مرتب کنند، برنامه‌های زمانی را مدیریت کنند یا مخازن کد را در Dependabot مورد بررسی قرار دهند، بدون اینکه توسعه‌دهنده درگیر مدیریت یک سرور کامل شود.

برای سال‌ها، برنامه‌نویسان بین دو گزینه سخت گیر بودند: سادگی سرویس‌های بدون سرور (Serverless) یا پایداری ماشین‌های مجازی (VM). همان‌طور که در تحلیل قبلی ما درباره‌ی امنیت گردش‌کارهای مبتنی بر جمینای در کلاد ران اشاره کردیم، صنعت مدت‌ها به دنبال راه حلی بود که در آن «وضعیت» (State) برنامه بدون نیاز به نگهداری دستی سرور، حفظ شود.

زمینه و نیازهای عامل‌های دائمی

عامل‌های هوش مصنوعی (AI Agents) — شبیه دستیاران اداری که هر لحظه آماده‌اند تا دستورات شما را اجرا کنند — دیگر فقط به یک سؤال پاسخ نمی‌دهند. آن‌ها در پس‌زمینه کار می‌کنند تا مثلاً خلاصه اخبار صبحگاهی را آماده کنند، یک برنامه روزانه را در قالب پادکست تحویل دهند یا هشدارها را در طول شب دسته‌بندی کنند. پس از اتمام این وظایف، آن‌ها منتظر محرک (Trigger) بعدی می‌مانند.

بر اساس گزارش فنی منتشر شده در ۲ اکتبر ۲۰۲۶، چالش اصلی برای عامل‌های خودکار، برآوردن یک نیاز سه‌گانه است:

  • عملکرد مداوم: عامل باید بتواند کارهای خود را زمان‌بندی کند و بدون نیاز به یک برنامه‌ریز خارجی، خودش را بیدار کند.
  • حافظه پایدار: تاریخچه، حافظه و برنامه‌ریزی‌ها باید پس از به‌روزرسانی‌ها یا ری‌استارت‌های سیستم، از بین نروند.
  • سادگی: راه‌اندازی باید با یک آدرس وب ثابت و بدون نیاز به مدیریت سرور باشد.

توابع بدون سرور استاندارد در اینجا شکست می‌خورند؛ چون وقتی درخواستی دریافت نمی‌کنند، خاموش می‌شوند و تمام حافظه و حلقه‌های فعال عامل پاک می‌شود.

مقایسه معماری‌های میزبانی

برای حل این مشکل، در یک بررسی فنی سه معماری مختلف با هم مقایسه شدند تا بهترین گزینه برای میزبانی عامل‌ها مشخص شود:

  • Cloud Run Services: برای اپلیکیشن‌های وب عالی هستند چون امنیت، لاگ‌ها و آدرس URL را بدون مدیریت سرور فراهم می‌کنند. اما در زمان بیکاری «می‌روند» (Sleep)، که برای عاملی که حلقه کاری‌اش با خاموش شدن سرویس ناپدید می‌شود، یک نقص مرگبار است.
  • ماشین‌های مجازی (VMs): این‌ها همیشه بیدارند و همه چیز را به خاطر می‌سپارند و نیاز به تداوم و حافظه را پوشش می‌دهند. اما بار سنگین مدیریت، از جمله تنظیم فایروال، به‌روزرسانی سیستم‌عامل، نظارت (Supervision) و مدیریت گواهینامه‌ها را به دوش برنامه‌نویس می‌اندازند. این حجم از مدیریت برای برنامه‌ای که بیشتر وقتش را در حالت انتظار می‌گذراند، بیش از حد است.
  • Cloud Run Instances: یک منبع جدید شامل یک کانتینر تک‌واحدی است که همیشه روشن است. این مدل آدرس ثابت و حافظه‌ای فراهم می‌کند که در برابر هر اتفاقی باقی می‌ماند. همچنین می‌توان آن را با کمترین تلاش شروع کرد، متوقف کرد یا به‌روزرسانی نمود.

نمونه‌های Cloud Run: میزبانی عامل هوش مصنوعی در حال اجرای مداوم

جزئیات فنی، عملکرد و هزینه

تست‌های انجام شده با Hermes Agent — یک عامل متن‌باز که توسط Gemma 4 قدرت گرفته — نشان داد که این مدل Instance بسیار مقرون‌به‌صرفه است. این عامل از طریق یک سرویس مجزای Cloud Run که مجهز به واحد پردازش گرافیکی (GPU) است با مدل ارتباط برقرار می‌کند، زیرا خودِ این Instanceها فعلاً از GPU پشتیبانی نمی‌کنند.

یک هفته تست نشان داد که عامل در برابر ری‌استارت‌های اجباری گوگل برای نگهداری، تنها در ۲۰ ثانیه زنده مانده و ظرف ۹۰ ثانیه کارش را از سر گرفته است. هزینه پایین (شروع از ۵.۷۰ دلار در ماه برای کوچک‌ترین اندازه) به دلیل تخصیص منعطف CPU است. سیستم در حالت عادی توان کمی مصرف می‌کند، اما وقتی عامل در حال «تفکر» یا فراخوانی ابزارهاست، می‌تواند تا سه و نیم دقیقه به حداکثر توان برسد. معمولاً دو دقیقه آرامش کافی است تا سیستم به حالت پایه خود بازگردد.

محدودیت‌های حیاتی

با این حال، چون این ویژگی در حالت پیش‌نمایش (Preview) است و از اواخر اوت ۲۰۲۶ عرضه شده، چندین محدودیت باقی مانده است:

  • محدودیت منطقه‌ای: همه مناطق این قابلیت را ندارند. در اروپا، تنها یک منطقه است که هم Instance و هم سرویس GPU مورد نیاز برای مدل هوش مصنوعی را هم‌زمان ارائه می‌دهد.
  • ماهیت ذخیره‌سازی: حافظه آن یک دیسک واقعی نیست. این فضای ذخیره‌سازی برای فایل‌هایی که توسط یک برنامه به‌صورت یک‌باره نوشته می‌شوند مناسب است، اما برای پایگاه‌های داده پیچیده کاربرد ندارد.
  • چرخه‌های نگهداری: تقریباً هر هفته یک بار ری‌استارت رخ می‌دهد؛ بنابراین عامل‌ها باید طوری طراحی شوند که برنامه‌ریزی خود را از حافظه ذخیره بازخوانی کنند، نه حافظه موقت (Volatile Memory).
  • زمان توقف به‌روزرسانی: به‌روزرسانی کانتینر باعث قطع سرویس برای حدود دو دقیقه می‌شود.

توصیه می‌شود تنظیماتی که زیاد تغییر می‌کنند در یک Secret Manager یا فایل ذخیره‌سازی خارجی نگه داشته شوند تا نیاز به به‌روزرسانی‌های مکرر کانتینر و قطعی‌های احتمالی نباشد.

مزیت سندباکس‌ها

یکی از نقاط قوت برجسته این سیستم، توانایی اجرای سندباکس‌های کد (Code Sandboxes) در چند میلی‌ثانیه است. وقتی عامل کدی تولید می‌کند، می‌تواند آن را در محیطی ایزوله اجرا کند بدون اینکه به سیستم میزبان آسیب بزند. این محیط‌ها به‌طور پیش‌فرض به اینترنت، اعتبارنامه‌های عامل یا حافظه اصلی دسترسی ندارند تا کدهای «توهم‌زده» (Hallucinated) باعث تخریب سیستم نشوند.

جدول مقایسه‌ای نهایی

ویژگی Cloud Run Service ماشین مجازی (VM) Cloud Run Instance
اجرای مداوم خیر بله بله
حفظ حافظه خیر بله بله
آدرس وب ارائه شده تنظیم دستی ارائه شده و ثابت
مدیریت سرور ندارد زیاد ندارد
هزینه بیکاری صفر اندازه‌گیری شده ۵.۷۰ دلار/ماه (روشن) / ۰ (خاموش)

در نهایت، این تغییر یعنی دنیای بدون سرور بالاخره یاد گرفت چگونه وضعیت خود را حفظ کند. اگرچه پردازش‌های موازی عظیم هنوز به سرویس‌های استاندارد Cloud Run نیاز دارند، اما «عامل‌های پس‌زمینه» حالا خانه‌ای اختصاصی و ارزان دارند.

اگر در حال ساخت گردش‌کارهای خودکار هستید، منتظر گسترش آتی سرویس‌های Cloud Run باشید که نویسنده به آن اشاره کرده است؛ این به‌روزرسانی‌ها احتمالاً نحوه تعامل عامل‌ها با ابزارهای خارجی را بیش از پیش بهینه خواهد کرد.

گام بعدی شما

  • اگر از مدل‌های Gemma 4 استفاده می‌کنید، معماری Instance را برای جایگزینی با VMهای گران‌قیمت تست کنید.
  • برای جلوگیری از توقف سرویس، تنظیمات متغیر خود را به خارج از کانتینر منتقل کنید.
  • استراتژی بازخوانی حافظه (State Recovery) را در کد عامل خود پیاده کنید تا ری‌استارت‌های هفتگی گوگل باعث توقف کار نشود.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این قابلیت با حذف هزینه‌های بالای مدیریت سرور، استقرار عامل‌های هوش مصنوعی را برای توسعه‌دهندگان مستقل اقتصادی می‌کند. اعتبار این تغییر در توانایی گوگل برای ترکیب سادگی Serverless با پایداری VMها نهفته است.

تأثیر برای ایران

به‌دلیل تحریم‌ها و محدودیت‌های دسترسی به کنسول گوگل کلاد، استفاده از این سرویس برای توسعه‌دهندگان ایرانی نیازمند زیرساخت‌های واسط یا حساب‌های خارجی است.

·نگاه ما
تحریریه دات‌هوش

جایگزینی ماشین‌های مجازی با Instanceهای ارزان‌قیمت، سد ورود برای استقرار عامل‌های خودکار را به‌شدت پایین می‌آورد. این یعنی ما از دوران «چت‌بات‌های واکنشی» به سمت «عامل‌های فعال» حرکت می‌کنیم که بدون تحریک کاربر، در پس‌زمینه زندگی دیجیتال ما سازماندهی می‌کنند. در واقع، گوگل با این حرکت، زیرساخت لازم برای تبدیل AI از یک ابزار جست‌وجو به یک اپراتور عملیاتی را فراهم کرده است.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.