پرش به محتوای اصلی
پرش به محتوای مقاله

استاندارد ACE: شتاب‌دهنده جدید x86 برای محاسبات ماتریسی هوش مصنوعی

·۲۸ خرداد ۱۴۰۵۱ دقیقه مطالعه
لوگوی گروه مشورتی اکوسیستم x86 برای مشخصات ACE (افزونه‌های پردازشی هوش مصنوعی)
لوگوی گروه مشورتی اکوسیستم x86 برای مشخصات ACE (افزونه‌های پردازشی هوش مصنوعی)
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

معرفی یک استاندارد سخت‌افزاری مشترک برای x86 که ضرب ماتریسی را از طریق ثبات‌های کاشی (Tile Registers) شتاب می‌دهد، به‌جای تکیه صرف بر دستورات برداری سنتی.

اگر امروز یک توسعه‌دهنده هستید که مدل‌های زبانی را به‌صورت محلی اجرا می‌کنید، گلوگاه اصلی شما دیگر رم یا گرافیک نیست، بلکه نحوه مدیریت ریاضیات سنگین در قلب پردازنده است. در ۱۵ ژوئن ۲۰۲۶، گروه مشورتی اکوسیستم x86 (x86 Ecosystem Advisory Group) از مشخصات فنی ACE (AI Compute Extensions) پرده برداشت تا شتاب‌دهنده یادگیری ماشین را مستقیماً در معماری x86 جاسازی کند.

همان‌طور که در تحلیل‌های قبلی ما درباره‌ی رایانش لبه اشاره کردیم، انتقال مدل‌ها از ابر به دستگاه‌های کاربر، نیاز به روش‌هایی دارد که محاسبات متراکم را بدون اتلاف انرژی انجام دهد. استنتاج (Inference) — که شبیه به لحظهٔ واقعی آشپزی است، نه دوره‌ی آموزش آشپز — در این استاندارد با بهینه‌ترین حالت ممکن پیاده شده است. این حرکت تلاش x86 برای حفظ سلطه در برابر رقبای مبتنی بر ARM است.

طبق مستندات x86ecosystem.org، استاندارد ACE بر چهار محور فنی متمرکز است:

  • ایجاد حالت‌های جدید ثبات ACE، شامل ثبات‌های مقیاس بلوکی و کاشی.
  • عملیات پردازش داده که از ورودی‌های Thبات AVX برای کار روی حالت‌های ثبات کاشی استفاده می‌کند.
  • عملیات انتقال داده اختصاصی برای جابه‌جایی سریع اطلاعات بین ثبات‌های ACE و AVX.
  • ادغام مدیریت سیستم و تبدیل فرمت‌ها در چارچوب AVX10.

لوگوی گروه مشورتی اکوسیستم x86 برای مشخصات ACE (افزونه‌های پردازشی هوش مصنوعی)

به گزارش این گروه، ترکیب تراکم محاسباتی پردازش‌های کاشی با انعطاف‌پذیری بردارهای AVX، اجازه می‌دهد پردازنده هسته‌ی ضرب ماتریسی — که شالوده تمام مدل‌های هوش مصنوعی است — را با بازدهی بسیار بیشتری اجرا کند. برای یک صاحب کسب‌وکار، این یعنی کاهش تأخیر در عامل‌های (Agents) محلی و وابستگی کمتر به GPUهای گران‌قیمت برای کارهای پایه.

گام بعدی شما

  • هنگام خرید پردازنده‌های نسل جدید، در لیست مشخصات فنی به دنبال عبارت «ACE Compatible» بگردید.
  • اگر از کتابخانه‌های ریاضی در سطح C++ استفاده می‌کنید، مستندات AVX10 را برای بهره‌برداری از این ثبات‌ها دنبال کنید.

اما این تغییر در سطح دستورالعمل‌ها، تنها بخشی از یک تغییر بزرگ‌تر در طراحی سیلیکون است؛ برای درک اینکه سخت‌افزارها چگونه در حال تغییر هستند، به بررسی ما درباره معماری‌های NPU مراجعه کنید.

چرا این موضوع مهم است؟

این استاندارد با تکیه بر اعتبار کنسرسیوم x86، هزینه‌ی استنتاج مدل‌های محلی را کاهش می‌دهد. این موضوع باعث می‌شود اجرای هوش مصنوعی زاینده در لبه، از نظر مصرف انرژی و سرعت، با استانداردهای صنعتی هم‌راستا شود.

تأثیر برای ایران

این تغییر در سطح سخت‌افزاری است و اثر آن از طریق به‌روزرسانی پردازنده‌های جدید در بازار ایران حس خواهد شد. توسعه‌دهندگان ایرانی می‌توانند با استفاده از این قابلیت در نسل‌های جدید CPU، مدل‌های محلی را بهینه‌تر اجرا کنند.

·نگاه ما
تحریریه دات‌هوش

جایگاه x86 در حال تغییر از یک پردازنده همه‌منظوره به یک سیلیکون تخصصی برای AI است. ACE در واقع تلاشی است تا فاصله عملکردی بین CPU و NPU را کم کند و اجازه دهد مدل‌های کوچک زبانی بدون نیاز به شتاب‌دهنده خارجی، با سرعت قابل‌قبولی روی لپ‌تاپ‌ها اجرا شوند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

موضوع‌ها

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.