پرش به محتوای اصلی
پرش به محتوای مقاله

«حذف انحصار سخت‌افزاری»؛ هدف از عرضه Mojo 1.0 تحت لایسنس Apache

·۲۸ مرداد ۱۴۰۵۶ دقیقه مطالعه
ModCon 2026: متن‌باز، ابر متن‌باز، سیلیکون متن‌باز
ModCon 2026: متن‌باز، ابر متن‌باز، سیلیکون متن‌باز
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

متن‌باز شدن کامل زبان Mojo 1.0 و ابزارهای آن، در کنار پشتیبانی بومی از سخت‌افزارهای متنوع (TPU و کوالکام) و ویندوز، که اجازه می‌دهد یک کد بدون تغییر روی تراشه‌های مختلف اجرا شود.

اگر امروز کدی را برای یک GPU خاص بهینه می‌کنید، احتمالاً می‌دانید که انتقال آن به یک شتاب‌دهنده دیگر به معنای بازنویسی بخش بزرگی از زیرساخت نرم‌افزاری است. این بن‌بست فنی، دقیقاً همان جایی است که Modular در ۱۹ اوت ۲۰۲۶ با متن‌باز کردن Mojo 1.0 تحت لایسنس Apache 2.0 تصمیم گرفت آن را بشکند.

برای سال‌ها، توسعه‌دهندگان هوش مصنوعی در تله‌ی «قفل سخت‌افزاری» گرفتار بوده‌اند. به گزارش Modular، اگر شما یک مدل را برای GPUهای انویدیا بهینه کنید، انتقال آن به یک شتاب‌دهنده تخصصی هوش مصنوعی اغلب نیازمند بازنگری کامل در کدهای زیربنایی است. این اصطکاک باعث ایجاد یک گلوگاه شده است؛ وضعیتی که در آن سخت‌افزارهای فوق‌العاده‌ای وجود دارند، اما ابزارهای نرم‌افزاری برای استفاده از آن‌ها بیش از حد صلب و انعطاف‌ناپذیر هستند.

تصور کنید سعی دارید یک اپلیکیشن پیشرفته را روی گوشی خود اجرا کنید، اما متوجه می‌شوید که این اپلیکیشن فقط روی یک برند خاص از پردازنده‌ها کار می‌کند. این دقیقاً وضعیت فعلی زیرساخت‌های هوش مصنوعی در سطح سازمانی است. Modular در تلاش است تا یک «مترجم جهانی» برای محاسبات هوش مصنوعی بسازد تا یک قطعه کد واحد بتواند به‌طور بهینه روی CPUها، GPUها و شتاب‌دهنده‌های سفارشی اجرا شود.

متن‌باز شدن Mojo

شرکت Modular هفته‌ی گذشته اعلام کرد که Mojo به نسخه ۱.۰ رسیده است و بدین ترتیب یک بنیاد پایدار برای محیط‌های تولیدی (Production) ایجاد کرده است. حیاتی‌ترین جنبه‌ی انتشار نسخه ۱.۰، تضمین پایداری است: کدی که توسعه‌دهندگان امروز می‌نویسند، با تکامل پلتفرم در آینده از کار نخواهد افتاد و دچار شکست (Break) نمی‌شود.

طبق مستندات این شرکت، با انتقال کل زبان — شامل کامپایلر و ابزارها — به مدل متن‌باز تحت لایسنس بدون محدودیت Apache 2.0، Modular جامعه جهانی را دعوت می‌کند تا این زبان را برای پلتفرم‌های جدید گسترش دهند و اپلیکیشن‌های سفارشی خود را بر روی آن بنا کنند.

این حرکت در واقع ادامه یک روند باز شدن تدریجی پشته (Stack) نرم‌افزاری آن‌هاست؛ مسیری که از سال ۲۰۲۴ با باز کردن کتابخانه استاندارد Mojo و در سال ۲۰۲۵ با باز کردن هسته‌های MAX آغاز شده بود. هدف نهایی این است که اطمینان حاصل شود کدهای نوشته شده امروز، در طول مسیر تکامل پلتفرم، پایدار باقی می‌مانند.

گسترش افق سخت‌افزاری

یکی از تغییرات کلیدی و قابل توجه، گسترش Modular Platform برای پشتیبانی از طیف متنوعی از سیلیکون‌ها است. بر اساس سخنرانی کلیدی در کنفرانس ModCon، این پلتفرم اکنون به‌طور بومی از موارد زیر پشتیبانی می‌کند:

  • AWS Trainium و Google TPU (واحد پردازش تنسور)
  • شتاب‌دهنده‌های Qualcomm Cloud AI 100 Ultra و Qualcomm Dragonfly
  • CPUها و GPUهای استاندارد

Modular ادعا می‌کند که فعال‌سازی این پلتفرم‌های جدید در مقایسه با روش‌های سنتی، به کاهش ۱۰ برابری در تلاش‌های مهندسی منجر شده است. این بهره‌وری به توسعه‌دهندگان اجازه می‌دهد یک بار مدل را طراحی کنند و آن را روی معماری‌های سخت‌افزاری کاملاً متفاوت مستقر نمایند، بدون اینکه نیاز باشد کل پشته نرم‌افزاری را دوباره حول آن سخت‌افزار بازسازی کنند.

ابر Modular و مقیاس سازمانی

برای تسهیل دسترسی به این قابلیت‌ها، شرکت سرویس Modular Cloud را راه‌اندازی کرد؛ یک سرویس تولیدی که پیچیدگی‌های زیرساخت‌های ناهمگون (Heterogeneous) را انتزاع می‌کند. این سرویس اکنون به‌طور عمومی در آدرس console.modular.com در دسترس است.

Modular Cloud دو مسیر اصلی برای دسترسی فراهم می‌کند:

  • نقاط اتصال مشترک (Shared Endpoints): این بخش با OpenAI سازگار است و مدل قیمت‌گذاری «پرداخت به ازای هر توکن» را برای مدل‌های متن‌باز محبوب ارائه می‌دهد. توکن‌ها در واقع تکه‌های کوچکی از متن هستند که مدل مانند برش‌های کیک آن‌ها را پردازش می‌کند.
  • استقرارهای اختصاصی (Dedicated Deployments): نمونه‌های ایزوله و رزرو شده‌ای که می‌توانند روی توان محاسباتی Modular یا روی زیرساخت شخصی مشتری اجرا شوند.

چندین ماه است که Modular Cloud به‌طور بی‌سروصدا ترافیک OpenRouter را تحت نام ModelRun مدیریت می‌کند. در این بازه زمانی، نقاط اتصال این سرویس به‌طور مداوم در رتبه‌های برتر پلتفرم از نظر تأخیر (Latency) و توان عملیاتی (Throughput) در ترافیک‌های تولیدی قرار داشته‌اند؛ روندی که توسط شرکت مستقل بنچ‌مارک، Artificial Analysis، تأیید شده است.

شرکت MiniMax اکنون به عنوان یکی از مشتریان پیشرو ظاهر شده است. آن‌ها از یک استقرار اختصاصی Modular برای اجرای مدل M3 خود استفاده می‌کنند که ترافیک تولیدی را با سرعت میلیاردها توکن در دقیقه سرویس‌دهی می‌کند.

سرویس‌دهی به مدل M3 در این مقیاس، یک چالش سیستمی منحصر‌به‌فرد است. این مدل ترکیبی از یک پنجره زمینه (Context Window) یک میلیون توکنی — شبیه به میز کاری بزرگ که جای چندین ورق دارد نه کل کتابخانه — و قابلیت‌های چندوجهی (Multimodality) بومی است. همچنین از معماری MiniMax Sparse Attention (MSA) بهره می‌برد. MSA یک معماری توجه پراکنده نوآورانه است که به‌طور انتخابی به بلوک‌های KV مرتبط توجه می‌کند و بدین ترتیب محاسبات مورد نیاز را با افزایش اندازه زمینه کاهش می‌دهد.

برای دستیابی به این مقیاس، Modular مدل M3 را به‌طور بومی در MAX پیاده‌سازی کرد، هسته‌های تخصصی MSA را ساخت و تنظیم کرد و استقرار را بر اساس الگوهای ترافیکی واقعی MiniMax بهینه نمود.

شکستن سد ویندوز

در یک همکاری استراتژیک با تیم Microsoft Windows، Modular در حال آوردن پشتیبانی بومی ویندوز برای Mojo است. در حالی که کاربران ویندوز پیش از این متکی به زیرسیستم ویندوز برای لینوکس (WSL) بودند، پشتیبانی بومی این زبان را در دسترس میلیون‌ها توسعه‌دهنده‌ای قرار می‌دهد که مستقیماً در اکوسیستم ویندوز برنامه می‌سازند.

لوگان آیر، مدیر CVP پلتفرم ویندوز و توسعه‌دهندگان، خاطرنشان کرد که مایکروسافت متعهد است به توسعه‌دهندگان کمک کند تا به این ابزارها در پلتفرم انتخابی خود دسترسی داشته باشند و فرصت‌هایی را که Mojo برای کسانی که در حوزه‌ی سیستم‌ها و هوش مصنوعی کار می‌کنند ایجاد می‌کند، به رسمیت می‌شناسد.

اتحاد MAX

Modular همچنین در حال تکامل لایسنس MAX است؛ آن‌ها محدودیت‌های استفاده از دستگاه را حذف کرده و آن را به صورت Source-available (در دسترس بودن سورس کد) درآورده‌اند. آن‌ها در حال ایجاد یک برنامه اتحاد (Alliance Program) شامل فروشندگان سخت‌افزار، ارائه‌دهندگان مدل، شرکت‌های ابری و اپراتورهای مرکز داده هستند تا آینده‌ی این پلتفرم را شکل دهند.

این رویکرد از همین حالا نتایج خود را نشان داده است. مهندسان شرکت HTEC توانستند تنها در عرض چند ماه و با تعداد کمی مهندس، پشتیبانی از Google TPU را روی پلتفرم Modular فعال کنند. در این مورد، Modular به جای هدایت مستقیم ادغام، در نقش پشتیبان عمل کرد که این امر ثابت می‌کند اکوسیستم می‌تواند به‌طور مستقل بنیاد پلتفرم را گسترش دهد.

سایر استارتاپ‌های سخت‌افزاری مانند d-Matrix نیز به این تلاش پیوسته‌اند. سید شث، مؤسس و مدیرعامل d-Matrix، تأکید کرد که با ورود صنعت به عصر محاسبات ناهمگون پراکنده (Disaggregated Heterogeneous Compute)، استانداردهای باز ضروری هستند تا GPUها، CPUها و XPUها بتوانند به‌طور بهینه با یکدیگر همکاری کنند.

تحلیل: پایان سیلوهای سیلیکونی

این چرخش نشان‌دهنده حرکتی به سمت زیرساخت‌های «افقی» در هوش مصنوعی است. برای یک مدیر کسب‌وکار، این به معنای توانایی تغییر تامین‌کننده سخت‌افزار بر اساس قیمت یا عملکرد است، بدون اینکه گروگان یک اکوسیستم نرم‌افزاری خاص باشد. این وضعیت، سیلیکون را به یک کالا (Commodity) و نرم‌افزار را به محرک اصلی ارزش تبدیل می‌کند.

برای توسعه‌دهنده، متن‌باز شدن Mojo 1.0 ریسک پذیرش یک زبان جدید را کاهش می‌دهد. وقتی کامپایلر متن‌باز باشد، جامعه جهانی تداوم و بقای آن را تضمین می‌کند. اگر Modular واقعاً بتواند کاهش ۱۰ برابری در تلاش‌های مربوط به پورت کردن کد را محقق کند، به لایه پیش‌فرض بین مدل و سخت‌افزار (Metal) تبدیل خواهد شد.

گام بعدی شما

  • توسعه‌دهندگان اکنون می‌توانند نسخه متن‌باز Mojo 1.0 را در mojolang.org تست کنند.
  • برای بررسی نقاط اتصال تولیدی، به console.modular.com مراجعه کنید.
  • علاقه‌مندان به برنامه اتحاد می‌توانند از طریق [email protected] با آن‌ها در ارتباط باشند.

نشانه‌ی حیاتی بعدی که باید زیر نظر داشت، اولین فروشنده سخت‌افزاری شخص ثالثی است که MAX را به‌طور مستقل از تیم اصلی Modular ادغام کند؛ اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این اقدام با تکیه بر اعتبار لایسنس Apache 2.0، وابستگی استراتژیک صنعت AI به یک برند سخت‌افزاری خاص را می‌شکند. در نتیجه، هزینه‌های استنتاج در مقیاس سازمانی به دلیل رقابت بیشتر بین تراشه‌ها کاهش می‌یابد.

تأثیر برای ایران

به‌دلیل تحریم‌ها و محدودیت‌های API، دسترسی به Modular Cloud برای کاربران ایرانی دشوار است، اما متن‌باز شدن Mojo فرصتی برای برنامه‌نویسان داخلی است تا بدون نیاز به سخت‌افزارهای گران‌قیمت انویدیا، روی شتاب‌دهنده‌های جایگزین کد بهینه بنویسند.

·نگاه ما
تحریریه دات‌هوش

متن‌باز کردن Mojo در این مقطع، تلاشی برای تبدیل شدن به «استاندارد لایه میانی» است تا پیش از آنکه انویدیا یا گوگل استانداردهای بسته خود را تحمیل کنند، یک زبان مشترک ایجاد شود. اگر این استراتژی جواب دهد، قدرت از دست شرکت‌های تولید تراشه خارج شده و به کسانی منتقل می‌شود که لایه نرم‌افزاری بهینه‌ساز را کنترل می‌کنند. این یعنی انتقال از عصر «سخت‌افزار-محور» به عصر «کامپایلر-محور» در AI.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.