اگر امروز برای اجرای مدلهای زبانی بزرگ هزینههای گزاف توکنهای ابری را میپردازید، سختافزار جدید اپل میتواند این صورتحساب را به صفر برساند. اپل در ۲۵ اوت ۲۰۲۶ با رونمایی از تراشههای M6 و M5 Ultra، سقف حافظه یکپارچه را به ۵۱۲ گیگابایت ارتقا داد تا اجرای مدلهای با صدها میلیارد پارامتر روی دستگاه (On-device) ممکن شود.
این تغییر سختافزاری درست زمانی رخ میدهد که صنعت هوش مصنوعی به سمت استنتاج (Inference) — یعنی همان لحظهای که مدل واقعاً جواب تولید میکند، شبیه به خودِ آشپزی و نه دورهی آموزش آشپز — محلی حرکت میکند. سالها بود که اجرای مدلهای عظیم نیازمند ابرهای گرانقیمت و تحمل تأخیر بالا بود. حالا اپل با انتقال محاسبات به روی میز کار، توسعهدهندگانی را هدف قرار داده که میخواهند مدلها را بدون قبض ماهانه ابری، تنظیم دقیق (Fine-tuning) کنند؛ درست مثل وقتی که به یک پزشک عمومی، تخصص پوست میدهیم تا روی یک حوزه خاص دقیق شود.
تصور کنید ایستگاه کاری دارید که برای پردازش مدلی در ابعاد GPT، نیازی به اتصال اینترنت ندارد. این وعده اصلی مک استودیو جدید است که به عنوان بستر اصلی تراشه M5 Ultra معرفی شده است.
استراتژی جدید سیلیکون
سری سانتانام، نایبرئیس گروه مهندسی سیلیکون اپل، این عرضه را «جهشی عظیم در عملکرد و محاسبات هوش مصنوعی برای سیلیکون اپل» توصیف کرد. طبق اعلام اپل، استراتژی این شرکت ایجاد یک طیف کامل است؛ از مدلهای ۲ نانومتری بسیار بهینه برای نقطه ورود کاربران عادی تا غولهای چهار-دای (Quad-die) برای بارهای کاری در سطح زیرساختی.
این ماشینها در بازاری عرضه میشوند که شعار اصلی آن استنتاج محلی است: یعنی اجرای مدلها، عاملها (Agents) و تولیدکنندههای تصویر روی همان دستگاهی که مقابل شماست. این رویکرد نیاز به پرداخت هزینه به ازای هر توکن در ابر را از بین میبرد و دسکتاپهای با حافظه بالا را به عنوان یک مسیر ورود (On-ramp) برای توسعهدهندگان معرفی میکند.
همانطور که در تحلیلهای پیشین ما دربارهی امنیت مدلهای بازمتن اشاره کردیم، اجرای محلی مدلها تنها یک بحث سرعت نیست، بلکه مسئلهی حریم خصوصی است. در بازاری که اکنون تمرکز بر اجرای محلی مدلها، عاملها و تولیدکنندههای تصویر است، دسکتاپهای با حافظه بالا به جایگاهی برای توسعهدهندگان تبدیل شدهاند تا از پرداخت هزینه به ازای هر توکن (Token) — تکههای کوچکی از متن، شبیه برشهای یک کیک طولانی که مدل تکهتکه میخورد — در ابر خلاص شوند.
تراشه M6: بهرهوری ۲ نانومتری
تراشه M6 نخستین تجربه اپل در فرآیند ساخت ۲ نانومتری است. اگرچه اپل نام سازنده را نیاورد، اما طبق گزارشهای صنعتی، این شرکت در تمام نسلهای سیلیکون خود از TSMC استفاده کرده است. در صفحه محصول مک مینی ذکر شده که این دستگاه با ۱۰۰ درصد برق تجدیدپذیر در سراسر زنجیره تأمین تولید شده است.
این تراشه قلب تپنده مک مینی جدید است که با قیمت ۸۹۹ دلار از ۲۲ سپتامبر ۲۰۲۶ عرضه میشود. مشخصات کلیدی M6 عبارتند از:
- پردازنده ۱۲ هستهای که اپل آن را سریعترین هسته CPU جهان مینامد.
- پردازنده گرافیکی ۱۲ هستهای با شتابدهنده عصبی در هر هسته.
- موتور عصبی دوگانه ۱۶ هستهای با توان محاسباتی دو برابر نسل قبل.
- تا ۳۲ گیگابایت حافظه یکپارچه با پهنای باند ۱۷۰ گیگابایت بر ثانیه (۱۰ درصد بیشتر از M5).
به نقل از مستندات اپل، M6 در عملکرد چندرشتهای ۱.۲ برابر سریعتر از M5 است و در محاسبات گرافیکی برای کارهای هوش مصنوعی، افزایشی نزدیک به ۳۰ درصد در توان محاسباتی پیک (Peak Compute) دارد.
M5 Ultra: غول چهار-دای
تراشه M5 Ultra قدرتمندترین محصول این شرکت تا به امروز است که از طراحی چهار-دای (Quad-die) استفاده میکند. این تراشه در واقع دو مدل M5 Max را از طریق رابط UltraFusion بهروزرسانیشده به هم متصل میکند.
این معماری به سیستمعامل اجازه میدهد چهار قطعه سیلیکون مجزا را به عنوان یک پردازنده واحد ببیند. بر اساس اعلامیه اپل، این رابط پهنای باندی بیش از ۴.۴ ترابایت بر ثانیه بین دایها ایجاد میکند که تراکم اتصال آن ۶ برابر نسل قبل است.
این طراحی در واقع مقیاسبندی معماری Fusion است که ابتدا در ۳ مارس ۲۰۲۶ در خط تولید مکبوک پرو معرفی شد. در حالی که تراشههای لپتاپ به سقف ۱۲۸ گیگابایت حافظه یکپارچه و پهنای باند ۶۱۴ گیگابایت بر ثانیه رسیدند، M5 Ultra سقف حافظه را چهار برابر کرده و پهنای باند را برای دسکتاپ تقریباً دو برابر کرده است.
جزئیات فنی M5 Ultra:
- پردازنده تا ۳۶ هستهای و گرافیک ۸۰ هستهای.
- پهنای باند حافظه ۱.۲ ترابایت بر ثانیه (۵۰ درصد بیشتر از M3 Ultra).
- موتور عصبی ۳۲ هستهای و موتور رسانهای با چهار موتور کدگذاری/رمزگشایی ProRes.
- رمزگشایی سختافزاری AV1.
- شتابدهندههای عصبی یکپارچه در تمام ۸۰ هسته گرافیکی.
اپل ادعا میکند M5 Ultra در محاسبات گرافیکی هوش مصنوعی، ۴.۵ برابر قدرتمندتر از M3 Ultra و بیش از ۶ برابر قدرتمندتر از M1 Ultra است.
قیمتگذاری و دسترسی
مک مینی با تراشه M6 از ۸۹۹ دلار شروع میشود. برای کسانی که پهنای باند بیشتری میخواهند، اپل مدل مک مینی با تراشه M5 Pro را ارائه میدهد که از ۶۴ گیگابایت حافظه یکپارچه و پهنای باند ۳۰۷ گیگابایت بر ثانیه پشتیبانی میکند.
مک استودیو با پیکربندی M5 Max از ۲,۴۹۹ دلار شروع میشود و مدلهای M5 Ultra تا سقف ۵۱۲ گیگابایت حافظه قابل سفارش هستند. هر دو دستگاه از همین حالا پیشسفارش میپذیرند و ۲۲ سپتامبر ۲۰۲۶ ارسال میشوند. همچنین برنامه لیزینگ Apple Upgrade با پرداخت ماهانه ۴۸.۹۹ دلار برای ۳۶ ماه معرفی شده است.
اکوسیستم هوش مصنوعی محلی
اپل بهطور صریح ابزارهای محلی مانند LM Studio Bionic، Ollama و Draw Things را هدف قرار داده است. این استراتژی مک استودیو را به جایگزینی محلی برای زیرساختهای ابری هوش مصنوعی تبدیل میکند.
با این حال، یک نکته نرمافزاری وجود دارد. قابلیتهای Apple Intelligence و سیری جدید نیازمند macOS 27 هستند. این ویژگیها در حال حاضر محدود به برنامه بتای نرمافزاری اپل هستند و انتظار میرود نسخه نهایی آنها در پاییز امسال برای زبانهای پشتیبانیشده در دسترس عموم قرار گیرد.
نکات ریز عملکردی
باید توجه داشت که تمام اعداد مربوط به افزایش سرعت، اندازهگیریهای داخلی اپل در اوت ۲۰۲۶ روی واحدهای پیشتولید مک مینی و مک استودیو در برابر سختافزارهای نسل قبل با استفاده از بنچمارکهای استاندارد صنعت است. ادعای «سریعترین هسته CPU جهان» برای M6 بر اساس تستهای داخلی در برابر سیستمهای رقیب موجود در بازار است. همچنین، حافظه ۵۱۲ گیگابایتی یک گزینه سفارشی (Configure-to-Order) در مک استودیو M5 Ultra است و در پیکربندی پایه وجود ندارد.
تحلیل تحریریه
این عرضه کمتر درباره مصرفکننده عادی و بیشتر درباره «مصرفکننده حرفهای هوش مصنوعی» (AI Prosumer) است. اپل با رساندن حافظه یکپارچه به ۵۱۲ گیگابایت، عملاً نیاز بسیاری از توسعهدهندگانی که استنتاج محلی یا تنظیم دقیق در مقیاس کوچک انجام میدهند را به خوشههای گرانقیمت A100 یا H100 از بین برده است.
طراحی چهار-دای UltraFusion برنده واقعی مهندسی در اینجا است. این طراحی جریمههای تأخیری (Latency) را که معمولاً با سیستمهای چند-تراشهای همراه است حل میکند و یک استخر حافظه مشترک عظیم ایجاد میکند که برای مدلهای زبانی بزرگ (LLM) حیاتی است.
برای کاربر تجاری، این به معنای تغییر در هزینه هوش مصنوعی است. سرمایهگذاری از یک هزینه عملیاتی (هزینههای ابری به ازای هر توکن) به یک هزینه سرمایهای (سختافزار ردهبالا) تبدیل میشود. برای کسانی که با دادههای اختصاصی و محرمانه کار میکنند، دستاوردهای حریم خصوصی در استنتاج محلی، ارزش پیشنهادی اصلی است.
منتظر اولین بنچمارکهای مستقل از فرآیند ۲ نانومتری M6 باشید تا ببینیم آیا بهرهوری واقعی در دنیای واقعی با ادعاهای داخلی اپل مطابقت دارد یا خیر.
گام بعدی شما
- اگر توسعهدهنده هستید، بررسی کنید که آیا مدلهای مورد نیاز شما با کوانتش (Quantization) در ۵۱۲ گیگابایت حافظه جای میگیرند یا خیر.
- برای کاهش هزینههای API، ابزارهای Ollama را روی سختافزارهای فعلی تست کنید تا آمادگی مهاجرت به M5 Ultra را داشته باشید.
- وضعیت دسترسی به macOS 27 را دنبال کنید تا قابلیتهای Apple Intelligence را فعال کنید.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است — در حالی که اپل بر سختافزار مصرفکننده تمرکز کرده، رقابت در سطح زیرساختی با تلاش OpenAI برای کاهش وابستگی به انویدیا از طریق تراشه Jalapeño به نقطه جدیدی رسیده است. به تحلیل ما دربارهی تراشههای Blackwell مراجعه کنید.




گفتگو