تصور کنید هر بار که یک سؤال ساده از هوش مصنوعی میپرسید، بخشی از منابع فیزیکی یک مرکز داده در گوشهای از جهان مصرف میشود. اگر هنوز به بهینهسازی تعداد درخواستها فکر نمیکنید، احتمالاً هزینههای عملیاتی شما در مقیاس واقعی غیرقابلکنترل خواهد شد.
به گزارش وبسایت dev.to در ۲۰ سپتامبر ۲۰۲۶، واقعیتِ فشار فیزیکی بر مراکز داده باعث شده تا بهرهوری انرژی از یک هدف اخلاقی و اجتماعی به یک معیار فنی برای سنجش کیفیت مهندسی نرمافزار تبدیل شود. همانطور که در تحلیل قبلی ما دربارهی کاهش مصرف توکنها اشاره کردیم، صنعت اکنون دریافته است که نباید صرفاً به دلیل در دسترس بودن قدرت محاسباتی، از آن بیرویه استفاده کرد.
برای اکثر توسعهدهندگان، چالش اصلی مدیریت سیستمهای خنککننده نیست، بلکه کنترل تعداد دفعاتی است که یک اپلیکیشن، مدل را فراخوانی میکند. مدل زبانی بزرگ (LLM) — مثل کتابخانهداری که میلیاردها صفحه را خوانده و حالا با همان لحن کتابها جواب میدهد — برای هر پاسخ نیاز به استنتاج (Inference) دارد؛ یعنی لحظهای که مدل واقعاً جواب تولید میکند، شبیه به خودِ آشپزی و نه دورهی آموزش آشپز.
طبق مستندات منتشر شده، برای کاهش ردپای انرژی میتوان تغییرات معماری زیر را اعمال کرد:
- اندازهسنجی مدل (Model Right-Sizing): استفاده از مدلهای کوچکتر یا منطق برنامهنویسی سنتی برای کارهای ساده، به جای بهکارگیری مدلهای غولآسا.
- بهینهسازی درخواستها: جمعآوری تمام اطلاعات کاربر و ارسال یک درخواست کامل، به جای ارسال چندین درخواست کوچک و پراکنده.
- کشینگ (Caching): ذخیره نتایج تکراری برای جلوگیری از تولید مجدد پاسخ.
- دستهبندی (Batching): گروهبندی کارهای پسزمینه برای پردازش یکباره.
مدیریت دادهها نیز نقشی حیاتی دارد. ذخیره همیشگی تمام نتایج میانی، فشار بر زیرساختهای ذخیرهسازی و پشتیبان را افزایش میدهد. اجرای قوانین سختگیرانه برای حذف دادههای قدیمی، هم پیچیدگی فنی را کم میکند و هم مصرف منابع را کاهش میدهد.
این تغییر رویکرد به این معناست که موفقترین قابلیتهای هوش مصنوعی، لزوماً قدرتمندترینها نیستند، بلکه بهینهترینها خواهند بود. هدف نهایی یک مهندس این است که بفهمد کدام درخواست را اصلاً لازم نبود به مدل ارسال کند.
گام بعدی شما
- فرکانس فراخوانی APIهای خود را بررسی کنید و نقاط تکراری را شناسایی کنید.
- معیارهای «نرمافزار سبز» (Green Software) را دنبال کنید، زیرا احتمالاً روی قیمتگذاری ابری تأثیر میگذارند.
- برای کارهای ساده، جایگزینی LLM با مدلهای کوچکتر (SLM) را تست کنید.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است — به تحلیل ما دربارهی تراشههای Blackwell مراجعه کنید.




گفتگو