پرش به محتوای اصلی
پرش به محتوای مقاله

حافظه ۵۱۲ گیگابایتی M5 Ultra امکان اجرای مدل‌های ۱۰۰ میلیاردی را فراهم کرد

·۳ شهریور ۱۴۰۵۵ دقیقه مطالعه۱ بازدید
تراشه‌های M6 و M5 Ultra اپل برای جهشی بزرگ در پردازش هوش مصنوعی
تراشه‌های M6 و M5 Ultra اپل برای جهشی بزرگ در پردازش هوش مصنوعی
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

ارتقای سقف حافظه یکپارچه به ۵۱۲ گیگابایت در یک دستگاه دسکتاپ — این اولین باری است که سخت‌افزاری مصرفی اجازه اجرای مدل‌های زبانی ۱۰۰ میلیاردی را بدون نیاز به سرورهای سازمانی می‌دهد.

اگر امروز برای اجرای مدل‌های زبانی بزرگ هزینه‌های گزاف توکن‌های ابری را می‌پردازید، سخت‌افزار جدید اپل می‌تواند این صورت‌حساب را به صفر برساند. اپل در ۲۵ اوت ۲۰۲۶ با رونمایی از تراشه‌های M6 و M5 Ultra، سقف حافظه یکپارچه را به ۵۱۲ گیگابایت ارتقا داد تا اجرای مدل‌های با صدها میلیارد پارامتر روی دستگاه (On-device) ممکن شود.

این تغییر سخت‌افزاری درست زمانی رخ می‌دهد که صنعت هوش مصنوعی به سمت استنتاج (Inference) — یعنی همان لحظه‌ای که مدل واقعاً جواب تولید می‌کند، شبیه به خودِ آشپزی و نه دوره‌ی آموزش آشپز — محلی حرکت می‌کند. سال‌ها بود که اجرای مدل‌های عظیم نیازمند ابرهای گران‌قیمت و تحمل تأخیر بالا بود. حالا اپل با انتقال محاسبات به روی میز کار، توسعه‌دهندگانی را هدف قرار داده که می‌خواهند مدل‌ها را بدون قبض ماهانه ابری، تنظیم دقیق (Fine-tuning) کنند؛ درست مثل وقتی که به یک پزشک عمومی، تخصص پوست می‌دهیم تا روی یک حوزه خاص دقیق شود.

تصور کنید ایستگاه کاری دارید که برای پردازش مدلی در ابعاد GPT، نیازی به اتصال اینترنت ندارد. این وعده اصلی مک استودیو جدید است که به عنوان بستر اصلی تراشه M5 Ultra معرفی شده است.

استراتژی جدید سیلیکون

سری سانتانام، نایب‌رئیس گروه مهندسی سیلیکون اپل، این عرضه را «جهشی عظیم در عملکرد و محاسبات هوش مصنوعی برای سیلیکون اپل» توصیف کرد. طبق اعلام اپل، استراتژی این شرکت ایجاد یک طیف کامل است؛ از مدل‌های ۲ نانومتری بسیار بهینه برای نقطه ورود کاربران عادی تا غول‌های چهار-دای (Quad-die) برای بارهای کاری در سطح زیرساختی.

این ماشین‌ها در بازاری عرضه می‌شوند که شعار اصلی آن استنتاج محلی است: یعنی اجرای مدل‌ها، عامل‌ها (Agents) و تولیدکننده‌های تصویر روی همان دستگاهی که مقابل شماست. این رویکرد نیاز به پرداخت هزینه به ازای هر توکن در ابر را از بین می‌برد و دسکتاپ‌های با حافظه بالا را به عنوان یک مسیر ورود (On-ramp) برای توسعه‌دهندگان معرفی می‌کند.

همان‌طور که در تحلیل‌های پیشین ما درباره‌ی امنیت مدل‌های بازمتن اشاره کردیم، اجرای محلی مدل‌ها تنها یک بحث سرعت نیست، بلکه مسئله‌ی حریم خصوصی است. در بازاری که اکنون تمرکز بر اجرای محلی مدل‌ها، عامل‌ها و تولیدکننده‌های تصویر است، دسکتاپ‌های با حافظه بالا به جایگاهی برای توسعه‌دهندگان تبدیل شده‌اند تا از پرداخت هزینه به ازای هر توکن (Token) — تکه‌های کوچکی از متن، شبیه برش‌های یک کیک طولانی که مدل تکه‌تکه می‌خورد — در ابر خلاص شوند.

تراشه M6: بهره‌وری ۲ نانومتری

تراشه M6 نخستین تجربه اپل در فرآیند ساخت ۲ نانومتری است. اگرچه اپل نام سازنده را نیاورد، اما طبق گزارش‌های صنعتی، این شرکت در تمام نسل‌های سیلیکون خود از TSMC استفاده کرده است. در صفحه محصول مک مینی ذکر شده که این دستگاه با ۱۰۰ درصد برق تجدیدپذیر در سراسر زنجیره تأمین تولید شده است.

این تراشه قلب تپنده مک مینی جدید است که با قیمت ۸۹۹ دلار از ۲۲ سپتامبر ۲۰۲۶ عرضه می‌شود. مشخصات کلیدی M6 عبارتند از:

  • پردازنده ۱۲ هسته‌ای که اپل آن را سریع‌ترین هسته CPU جهان می‌نامد.
  • پردازنده گرافیکی ۱۲ هسته‌ای با شتاب‌دهنده عصبی در هر هسته.
  • موتور عصبی دوگانه ۱۶ هسته‌ای با توان محاسباتی دو برابر نسل قبل.
  • تا ۳۲ گیگابایت حافظه یکپارچه با پهنای باند ۱۷۰ گیگابایت بر ثانیه (۱۰ درصد بیشتر از M5).

به نقل از مستندات اپل، M6 در عملکرد چندرشته‌ای ۱.۲ برابر سریع‌تر از M5 است و در محاسبات گرافیکی برای کارهای هوش مصنوعی، افزایشی نزدیک به ۳۰ درصد در توان محاسباتی پیک (Peak Compute) دارد.

M5 Ultra: غول چهار-دای

تراشه M5 Ultra قدرتمندترین محصول این شرکت تا به امروز است که از طراحی چهار-دای (Quad-die) استفاده می‌کند. این تراشه در واقع دو مدل M5 Max را از طریق رابط UltraFusion به‌روزرسانی‌شده به هم متصل می‌کند.

این معماری به سیستم‌عامل اجازه می‌دهد چهار قطعه سیلیکون مجزا را به عنوان یک پردازنده واحد ببیند. بر اساس اعلامیه اپل، این رابط پهنای باندی بیش از ۴.۴ ترابایت بر ثانیه بین دای‌ها ایجاد می‌کند که تراکم اتصال آن ۶ برابر نسل قبل است.

این طراحی در واقع مقیاس‌بندی معماری Fusion است که ابتدا در ۳ مارس ۲۰۲۶ در خط تولید مک‌بوک پرو معرفی شد. در حالی که تراشه‌های لپ‌تاپ به سقف ۱۲۸ گیگابایت حافظه یکپارچه و پهنای باند ۶۱۴ گیگابایت بر ثانیه رسیدند، M5 Ultra سقف حافظه را چهار برابر کرده و پهنای باند را برای دسکتاپ تقریباً دو برابر کرده است.

جزئیات فنی M5 Ultra:

  • پردازنده تا ۳۶ هسته‌ای و گرافیک ۸۰ هسته‌ای.
  • پهنای باند حافظه ۱.۲ ترابایت بر ثانیه (۵۰ درصد بیشتر از M3 Ultra).
  • موتور عصبی ۳۲ هسته‌ای و موتور رسانه‌ای با چهار موتور کدگذاری/رمزگشایی ProRes.
  • رمزگشایی سخت‌افزاری AV1.
  • شتاب‌دهنده‌های عصبی یکپارچه در تمام ۸۰ هسته گرافیکی.

اپل ادعا می‌کند M5 Ultra در محاسبات گرافیکی هوش مصنوعی، ۴.۵ برابر قدرتمندتر از M3 Ultra و بیش از ۶ برابر قدرتمندتر از M1 Ultra است.

قیمت‌گذاری و دسترسی

مک مینی با تراشه M6 از ۸۹۹ دلار شروع می‌شود. برای کسانی که پهنای باند بیشتری می‌خواهند، اپل مدل مک مینی با تراشه M5 Pro را ارائه می‌دهد که از ۶۴ گیگابایت حافظه یکپارچه و پهنای باند ۳۰۷ گیگابایت بر ثانیه پشتیبانی می‌کند.

مک استودیو با پیکربندی M5 Max از ۲,۴۹۹ دلار شروع می‌شود و مدل‌های M5 Ultra تا سقف ۵۱۲ گیگابایت حافظه قابل سفارش هستند. هر دو دستگاه از همین حالا پیش‌سفارش می‌پذیرند و ۲۲ سپتامبر ۲۰۲۶ ارسال می‌شوند. همچنین برنامه لیزینگ Apple Upgrade با پرداخت ماهانه ۴۸.۹۹ دلار برای ۳۶ ماه معرفی شده است.

اکوسیستم هوش مصنوعی محلی

اپل به‌طور صریح ابزارهای محلی مانند LM Studio Bionic، Ollama و Draw Things را هدف قرار داده است. این استراتژی مک استودیو را به جایگزینی محلی برای زیرساخت‌های ابری هوش مصنوعی تبدیل می‌کند.

با این حال، یک نکته نرم‌افزاری وجود دارد. قابلیت‌های Apple Intelligence و سیری جدید نیازمند macOS 27 هستند. این ویژگی‌ها در حال حاضر محدود به برنامه بتای نرم‌افزاری اپل هستند و انتظار می‌رود نسخه نهایی آن‌ها در پاییز امسال برای زبان‌های پشتیبانی‌شده در دسترس عموم قرار گیرد.

نکات ریز عملکردی

باید توجه داشت که تمام اعداد مربوط به افزایش سرعت، اندازه‌گیری‌های داخلی اپل در اوت ۲۰۲۶ روی واحدهای پیش‌تولید مک مینی و مک استودیو در برابر سخت‌افزارهای نسل قبل با استفاده از بنچمارک‌های استاندارد صنعت است. ادعای «سریع‌ترین هسته CPU جهان» برای M6 بر اساس تست‌های داخلی در برابر سیستم‌های رقیب موجود در بازار است. همچنین، حافظه ۵۱۲ گیگابایتی یک گزینه سفارشی (Configure-to-Order) در مک استودیو M5 Ultra است و در پیکربندی پایه وجود ندارد.

تحلیل تحریریه

این عرضه کمتر درباره مصرف‌کننده عادی و بیشتر درباره «مصرف‌کننده حرفه‌ای هوش مصنوعی» (AI Prosumer) است. اپل با رساندن حافظه یکپارچه به ۵۱۲ گیگابایت، عملاً نیاز بسیاری از توسعه‌دهندگانی که استنتاج محلی یا تنظیم دقیق در مقیاس کوچک انجام می‌دهند را به خوشه‌های گران‌قیمت A100 یا H100 از بین برده است.

طراحی چهار-دای UltraFusion برنده واقعی مهندسی در اینجا است. این طراحی جریمه‌های تأخیری (Latency) را که معمولاً با سیستم‌های چند-تراشه‌ای همراه است حل می‌کند و یک استخر حافظه مشترک عظیم ایجاد می‌کند که برای مدل‌های زبانی بزرگ (LLM) حیاتی است.

برای کاربر تجاری، این به معنای تغییر در هزینه هوش مصنوعی است. سرمایه‌گذاری از یک هزینه عملیاتی (هزینه‌های ابری به ازای هر توکن) به یک هزینه سرمایه‌ای (سخت‌افزار رده‌بالا) تبدیل می‌شود. برای کسانی که با داده‌های اختصاصی و محرمانه کار می‌کنند، دستاوردهای حریم خصوصی در استنتاج محلی، ارزش پیشنهادی اصلی است.

منتظر اولین بنچمارک‌های مستقل از فرآیند ۲ نانومتری M6 باشید تا ببینیم آیا بهره‌وری واقعی در دنیای واقعی با ادعاهای داخلی اپل مطابقت دارد یا خیر.

گام بعدی شما

  • اگر توسعه‌دهنده هستید، بررسی کنید که آیا مدل‌های مورد نیاز شما با کوانتش (Quantization) در ۵۱۲ گیگابایت حافظه جای می‌گیرند یا خیر.
  • برای کاهش هزینه‌های API، ابزارهای Ollama را روی سخت‌افزارهای فعلی تست کنید تا آمادگی مهاجرت به M5 Ultra را داشته باشید.
  • وضعیت دسترسی به macOS 27 را دنبال کنید تا قابلیت‌های Apple Intelligence را فعال کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — در حالی که اپل بر سخت‌افزار مصرف‌کننده تمرکز کرده، رقابت در سطح زیرساختی با تلاش OpenAI برای کاهش وابستگی به انویدیا از طریق تراشه Jalapeño به نقطه جدیدی رسیده است. به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این سخت‌افزار با تکیه بر اعتبار مهندسی سیلیکون اپل، وابستگی توسعه‌دهندگان به زیرساخت‌های ابری را می‌شکند. انتقال مدل‌های عظیم به محیط محلی، حریم خصوصی داده‌های حساس شرکتی را تضمین می‌کند.

تأثیر برای ایران

به‌دلیل قیمت بسیار بالای مدل‌های Ultra و محدودیت‌های واردات، این سخت‌افزار بیشتر برای مراکز پژوهشی ایران کاربرد دارد تا توسعه‌دهندگان مستقل. دسترسی به macOS 27 برای فعال‌سازی قابلیت‌های AI همچنان نیازمند دور زدن محدودیت‌های منطقه‌ای است.

·نگاه ما
تحریریه دات‌هوش

اپل با این حرکت، هزینه هوش مصنوعی را از یک هزینه جاری (OpEx) به یک هزینه سرمایه‌ای (CapEx) تبدیل کرد. حذف نیاز به خوشه‌های A100 برای استنتاج محلی، عملاً قدرت مدل‌های ۱۰۰ میلیاردی را به میز کار توسعه‌دهندگان آورد. برنده واقعی این بازی، معماری UltraFusion است که گلوگاه تأخیر در سیستم‌های چند-تراشه‌ای را حل کرده است.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.