پرش به محتوای اصلی
پرش به محتوای مقاله

پردازنده ۲ نانومتری فوجی‌تسو مصرف برق استنتاج هوش مصنوعی را نصف کرد

·۲۳ شهریور ۱۴۰۵۵ دقیقه مطالعه۲ بازدید
پردازنده ۲ نانومتری فوجیتسو-موناکا و سرور هوش مصنوعی بومی رونمایی شد
پردازنده ۲ نانومتری فوجیتسو-موناکا و سرور هوش مصنوعی بومی رونمایی شد
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

جایگزینی GPUهای پرمصرف با CPUهای ۲ نانومتری برای استنتاج در مقیاس صنعتی؛ این اولین بار است که یک پردازنده عمومی ادعای نصف کردن تعداد سرورهای مورد نیاز برای AI را دارد.

اگر امروز برای استقرار مدل‌های هوش مصنوعی در مراکز داده هزینه می‌کنید، احتمالاً نیمی از فضای سرورها و قبض برق شما را می‌توان حذف کرد. این ادعای جسورانه، محور اصلی معرفی پردازنده جدید فوجی‌تسو است که بازی استقرار مدل‌ها را تغییر می‌دهد.

فوجی‌تسو (Fujitsu Limited) در ۱۴ سپتامبر ۲۰۲۶ اعلام کرد که فروش جهانی پردازنده FUJITSU-MONAKA و سرورهای همراه آن را از نوامبر ۲۰۲۶ آغاز می‌کند. این سخت‌افزار به‌گونه‌ای طراحی شده که تعداد سرورهای مورد نیاز برای استنتاج (Inference) — یعنی همان لحظه‌ای که مدل واقعاً جواب تولید می‌کند، شبیه به آشپزی بعد از یک دوره آموزش طولانی — را به نصف می‌رساند.

زمینه و محرک‌های استراتژیک

این تحول در حالی رخ می‌دهد که گسترش هوش مصنوعی زاینده (Generative AI) — مثل کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن جواب می‌دهد — باعث کمبود شدید منابع محاسباتی و جهش تقاضای برق شده است. بسیاری از سازمان‌ها اکنون برای مدیریت داده‌های محرمانه، به زیرساخت‌های درون‌سازمانی نیاز دارند، به‌ویژه در مکان‌هایی که سیستم‌های خنک‌کننده آبی پیشرفته ندارند.

همان‌طور که در تحلیل‌های قبلی ما درباره‌ی امنیت مدل‌های بازمتن اشاره کردیم، استقلال سخت‌افزاری برای حریم خصوصی حیاتی است. فوجی‌تسو با تولید این قطعات در کارخانه کاساشیما، قصد دارد ریسک‌های ژئوپلیتیک را کاهش دهد و شفافیت زنجیره تأمین را تضمین کند. این رویکرد، مفهوم هوش مصنوعی حاکمیتی (Sovereign AI) را تقویت می‌کند که برای بخش‌های دفاعی و امنیت ملی کشورها حیاتی است.

طبق اعلام این شرکت، تکنولوژی MONAKA حاصل پروژه‌ای با حمایت سازمان توسعه صنعتی و تکنولوژی انرژی جدید (NEDO) است. این تمرکز بر تولید داخلی باعث می‌شود تا قابلیت ردیابی (Traceability) کاملاً فراهم شود؛ به این معنا که منشأ تمامی قطعات و تاریخچه ساخت آن‌ها به‌طور دقیق قابل مشاهده و پیگیری است.

پردازنده FUJITSU-MONAKA از معماری سه‌بعدی (3D-stacked) استفاده می‌کند. در این طراحی، یک فرآیند ۲ نانومتری برای هسته‌ها با یک فرآیند ۵ نانومتری برای بخش‌های حافظه کش و ورودی/خروجی (I/O) ترکیب شده است تا تعادلی میان هزینه و کارایی ایجاد شود. این پیشروی در لیتوگرافی مشابه رویکرد شرکت‌های پیشرو دیگر است؛ برای مثال، پردازنده ۲ نانومتری IBM نیز با هدف بهینه‌سازی اکوسیستم Arm در مین‌فریم‌ها معرفی شد تا کارایی محاسباتی را ارتقا دهد. طبق گفته‌های شرکت، این طراحی اجازه می‌دهد پردازنده با ولتاژ بسیار پایین و فرکانس حداکثری ۳.۸ گیگاهرتز عمل کند و سرعت انتقال حافظه آن به ۸۸۰۰MT/s برسد.

جزئیات فنی

مشخصات فنی کلیدی این سخت‌افزار عبارت است از:

  • شتاب‌دهی هوش مصنوعی: دستورالعمل‌های اختصاصی برای عملیات ماتریسی و عملیات برداری SVE2 که با بهینه‌سازی‌های نرم‌افزاری ترکیب شده‌اند.
  • کارایی: توان عملیاتی دو برابری در استنتاج نسبت به پردازنده‌های رقیب، که منجر به نصف شدن مصرف برق و تعداد سرورها برای بارهای کاری مشابه می‌شود.
  • امنیت: رمزنگاری سخت‌افزاری از طریق Arm CCA برای محاسبات محرمانه (Confidential Computing). این قابلیت داده‌ها را حتی از هایپروایزرها و سیستم‌عامل‌ها پنهان می‌کند و از استفاده امن در محیط‌های ابری چندمستاجری (Multi-tenant) پشتیبانی می‌کند.

خط تولید سرور و ساخت

مجموعه سرورهای Fujitsu MONAKA پیکربندی‌های متنوعی را ارائه می‌دهد. از نوامبر ۲۰۲۶، این شرکت سرورهای رک‌مانت 2U با دو پردازنده و سرورهای رک‌مانت 1U با یک یا دو پردازنده را در ژاپن و اروپا عرضه خواهد کرد. این مدل‌ها به‌طور خاص برای عامل‌های هوش مصنوعی و استنتاج بهینه شده‌اند.

مدل رک‌مانت 1U از فناوری CDI/CXL (زیرساخت تجزیه‌شده قابل ترکیب و لینک اکسپرس محاسباتی) استفاده می‌کند تا حافظه و شتاب‌دهنده‌ها را فراتر از مرزهای فیزیکی یک سرور تخصیص دهد. این قابلیت، مشکل رایج کمبود حافظه در استنتاج مدل‌های بزرگ را حل کرده و اجازه می‌دهد سیستم‌ها با مدل‌های عظیم هوش مصنوعی در آینده سازگار شوند.

این مدل در دمای محیط تا ۴۰ درجه سانتی‌گراد با خنک‌کننده هوا و تا ۴۵ درجه با خنک‌کننده آبی کار می‌کند. این ویژگی باعث می‌شود مصرف برق سیستم‌های خنک‌کننده تا ۸۰٪ کاهش یابد، بدون اینکه نیازی به زیرساخت‌های سرمایشی تخصصی باشد.

برای بخش‌های دانشگاهی و محاسبات سریع (HPC)، فوجی‌تسو سرورهای چندگره (multi-node) 2U را عرضه می‌کند که در هر گره دو پردازنده و در هر سیستم چهار گره وجود دارد. این سرورها برای بارهای کاری سنگین مانند تحلیل‌های سیالاتی و مدل‌های جایگزین (Surrogate Models) طراحی شده‌اند.

تولید و اکوسیستم

این عرضه بر پایه اقدامات فوریه ۱۲، ۲۰۲۶ است که در آن فوجی‌تسو تولید سرورهای هوش مصنوعی حاکمیتی در کارخانه کاساشیما را از مارس ۲۰۲۶ اعلام کرد. این سیستم‌ها شامل تجهیزاتی مجهز به GPUهای NVIDIA HGX B300 و NVIDIA RTX PRO 6000 Blackwell Server Edition بودند.

کارخانه کاساشیما از تخصص به‌دست‌آمده در ساخت ابرکامپیوتر Fugaku بهره می‌برد و یک سیستم تولید داخلی یکپارچه، از برد مدار چاپی تا مونتاژ نهایی دستگاه را اجرا می‌کند. همچنین فوجی‌تسو همکاری خود را با شرکت Super Micro Computer در زمینه‌های برنامه‌ریزی، توسعه، تولید، فروش و نگهداری گسترش داده است.

فوجی‌تسو اکنون این سخت‌افزار را با پلتفرم Fujitsu Kozuchi و هوش مصنوعی زاینده Takane ادغام کرده تا یک پشته (Stack) کامل و حاکمیتی ایجاد کند. این پلتفرم تدابیر اضافه‌ای برای ردیابی، امنیت و شفافیت در خودمختاری عملیاتی اضافه می‌کند تا از مدیریت داده‌ها و حاکمیت داخلی پشتیبانی کند.

این استراتژی، توازن قدرت در هوش مصنوعی را تغییر می‌دهد؛ زیرا وابستگی مطلق به خوشه‌های عظیم GPU که نیاز به خنک‌کننده آبی دارند را برای استنتاج از بین می‌برد. در حالی که غول‌هایی مانند OpenAI برای تامین نیازهای محاسباتی خود به توسعه زیرساخت‌های عظیم در مناطقی مانند مالزی روی آورده‌اند، فوجی‌تسو با فعال کردن استنتاج عملیاتی مستقیماً روی CPU، به شرکت‌ها اجازه می‌دهد عامل‌های هوش مصنوعی را در مراکز داده استاندارد مستقر کنند. این امر مانع ورود به دنیای هوش مصنوعی حاکمیتی را کاهش می‌دهد، جایی که امنیت ملی و اقامت داده‌ها (Data Residency) مهم‌تر از سرعت خام آموزش مدل‌هاست.

برای یک مدیر کسب‌وکار، این یعنی استقرار هوش مصنوعی دیگر به دسترسی به زیرساخت‌های خاص انویدیا گره نخورده است. توانایی اجرای استنتاج با توان عملیاتی بالا روی یک CPU کم‌مصرف و داخلی، هم هزینه‌های عملیاتی را می‌کاهد و هم ریسک ژئوپلیتیک تحریم‌های سخت‌افزاری را مدیریت می‌کند.

برنامه عرضه

فوجی‌تسو این پردازنده را به عنوان یک محصول مستقل در سه ماهه چهارم سال مالی ۲۰۲۶ به اپراتورهای ابری، اپراتورهای مرکز داده و فروشندگان سرور عرضه خواهد کرد و در دسترس جهانی آن شامل مناطق ایالات متحده و APAC خواهد بود.

سرورهای Fujitsu MONAKA از نیمه دوم سال مالی ۲۰۲۶ به مشتریان منتخب در بخش‌های مالی، مخابرات و تولید ارائه می‌شوند. ارسال این سرورها به ژاپن و اروپا به‌طور متوالی از آوریل ۲۰۲۷ آغاز خواهد شد.

در آینده باید منتظر عرضه سرورهای با تراکم بالا برای مراکز داده هوش مصنوعی و سرورهای در مقیاس رک (Rack-scale) باشید که دارای سیستم‌های نگهداری رباتیک خودمختار هستند.

گام بعدی شما

  • اگر در حال طراحی زیرساخت مرکز داده هستید، بررسی کنید آیا نیاز شما به GPUهای پرمصرف است یا استنتاج روی CPUهای بهینه پاسخگوست.
  • مدل‌های استقرار «حاکمیتی» را برای داده‌های حساس سازمان خود جایگزین سرویس‌های ابری خارجی کنید.
  • تحولات لیتوگرافی ۲ نانومتری را دنبال کنید تا متوجه شوید چه زمانی مدل‌های بزرگ‌تر روی سخت‌افزارهای کوچک‌تر جای می‌گیرند.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این محصول با تکیه بر تخصص فوجی‌تسو در ابررایانه‌ها، وابستگی صنعت به زنجیره تأمین انویدیا را می‌شکند. کاهش ۵۰ درصدی مصرف برق، استقرار هوش مصنوعی را برای سازمان‌های بدون زیرساخت خنک‌کننده پیشرفته ممکن می‌کند.

تأثیر برای ایران

به‌دلیل تحریم‌ها، دسترسی مستقیم به این سخت‌افزارها دشوار است، اما کاهش نیاز به سیستم‌های خنک‌کننده آبی، مدل استقرار این تکنولوژی را برای مراکز داده کوچک‌تر در ایران جذاب‌تر می‌کند.

·نگاه ما
تحریریه دات‌هوش

تمرکز فوجی‌تسو بر استنتاج در سطح CPU، یک چرخش راهبردی برای کاهش سلطه GPUهاست. این رویکرد نشان می‌دهد که آینده استقرار هوش مصنوعی در سازمان‌ها، نه در قدرت خام آموزش، بلکه در بهینه‌سازی هزینه و انرژی استنتاج نهفته است. در واقع، فوجی‌تسو در حال تبدیل کردن هوش مصنوعی از یک «پروژه گران‌قیمت زیرساختی» به یک «سرویس استاندارد مرکز داده» است.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.