پرش به محتوای اصلی
پرش به محتوای مقاله

تراشه Jalapeño: استراتژی OpenAI برای شکستن انحصار سخت‌افزاری

·۳ تیر ۱۴۰۵۲ دقیقه مطالعه۱ بازدید
تراشه سفارشی «هالاپینو» اوپن‌ای‌ای و برادکام برای استنتاج مدل‌های زبانی بزرگ
تراشه سفارشی «هالاپینو» اوپن‌ای‌ای و برادکام برای استنتاج مدل‌های زبانی بزرگ
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

طراحی کامل یک پردازنده اختصاصی در تنها ۹ ماه با کمک خودِ مدل‌های هوش مصنوعی؛ تغییری از مصرف‌کننده سخت‌افزار به تولیدکننده معماری سیلیکون.

صاحبان کسب‌وکارهایی که امروز هزینه‌های سرسام‌آوری بابت اجاره GPU پرداخت می‌کنند، باید به معماری سخت‌افزاری OpenAI دقت کنند. این شرکت تصمیم گرفته است تمام لایه‌های زنجیره تولید را در اختیار بگیرد و با معرفی Jalapeño، دوران وابستگی مطلق به پردازنده‌های عمومی را به چالش بکشد.

به نقل از بیانیه مشترک در ۲۴ ژوئن ۲۰۲۶، این پردازنده نخستین «پردازنده هوش» اختصاصی OpenAI است که با همکاری شرکت Broadcom طراحی شده است. کنترل روی سیلیکون به این شرکت اجازه می‌دهد مدل‌ها را سریع‌تر و پایدارتر اجرا کند و هم‌زمان هزینه‌های جاری را به‌شدت کاهش دهد. همان‌طور که در تحلیل قبلی ما درباره‌ی امنیت مدل‌های بازمتن اشاره کردیم، بهینه‌سازی لایه‌های زیرین، کلید دستیابی به مقیاس‌های جدید است. این حرکت در واقع تکرار روند کلی صنعت است؛ جایی که آزمایشگاه‌های بزرگ AI برای رهایی از محدودیت‌های پردازنده‌های گرافیکی (GPU) — که شبیه به اجاره یک آشپزخانه صنعتی گران‌قیمت برای پخت هر وعده غذاست — به سمت سخت‌افزارهای سفارشی می‌روند.

بر اساس مستندات منتشرشده، تراشه Jalapeño برخلاف مدل‌های اصلاح‌شده، از پایه برای استنتاج (Inference) — یعنی همان لحظه‌ای که مدل واقعاً جواب تولید می‌کند، شبیه به خودِ آشپزی و نه دوره‌ی آموزش آشپز — طراحی شده است. این پروژه بر پایه یک شراکت سه‌جانبه پیش می‌رود:

  • OpenAI: مسئولیت طراحی هسته تراشه را بر عهده دارد و برای تسریع این مسیر، از مدل‌های خود استفاده کرده است.
  • Broadcom: خدمات تولید سیلیکون و فناوری شبکه Tomahawk را فراهم می‌کند.
  • Celestica: مدیریت بردها، رک‌ها و یکپارچه‌سازی سیستم را بر عهده دارد.

طبق اعلام OpenAI، چرخه «طراحی تا تولید» تنها ۹ ماه زمان برده است. اگرچه اعداد رسمی تأیید نشده‌اند، اما تست‌های داخلی نشان می‌دهد بازدهی هر وات در این تراشه به‌طور قابل‌توجهی بهتر از سخت‌افزارهای فعلی است. در حال حاضر نمونه‌های مهندسی در حال اجرای عملیاتی مدل GPT-5.3-Codex-Spark هستند که پیش‌تر بر روی سخت‌افزارهای Cerebras اجرا می‌شد.

این چرخش به سمت یکپارچگی عمودی نشان می‌دهد که OpenAI کارایی را مرز اصلی برای نسل بعدی عامل‌ها می‌بیند. با بهینه‌سازی جابه‌جایی داده‌ها، این شرکت می‌کوشد وابستگی به شتاب‌دهنده‌های شخص ثالث را به کلی قطع کند.

به گزارش منابع صنعتی، هاک تان، مدیرعامل Broadcom، پیش‌بینی می‌کند نخستین استقرار در مقیاس گیگاوات تا اواخر سال ۲۰۲۶ رخ دهد. گفته می‌شود در این مسیر، Broadcom از مایکروسافت خواسته است تا برای تضمین فاز اول پروژه، خرید ۴۰ درصد از این تراشه‌ها را تضمین کند.

گام بعدی شما

  • تحلیل کنید که آیا کاهش هزینه استنتاج می‌تواند قیمت اشتراک‌های سازمانی مدل‌های OpenAI را پایین بیاورد؟
  • روند تغییرات سخت‌افزاری از GPUهای عمومی به ASICهای اختصاصی را در نقشه‌راه سال ۲۰۲۶ دنبال کنید.
  • بررسی کنید که آیا کاهش تأخیر سخت‌افزاری، امکان اجرای عامل‌های پیچیده‌تر را در زمان واقعی فراهم می‌کند یا خیر.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این اقدام با تکیه بر اعتبار Broadcom در طراحی ASIC، وابستگی استراتژیک OpenAI به انویدیا را می‌شکند. نتیجه این تغییر، کاهش چشمگیر هزینه هر توکن و افزایش سرعت پاسخ‌دهی مدل‌های نسل بعد خواهد بود.

تأثیر برای ایران

به‌دلیل تحریم‌ها و محدودیت‌های API، دسترسی مستقیم به سخت‌افزارهای بهینه‌شده OpenAI برای توسعه‌دهندگان ایرانی محدود است، اما کاهش احتمالی هزینه‌های استنتاج در سطح جهانی، هزینه استفاده از APIها را در بلندمدت ارزان‌تر می‌کند.

·نگاه ما
تحریریه دات‌هوش

تمرکز OpenAI بر سخت‌افزار نشان می‌دهد که مدل‌های زبانی بزرگ به سقف بهره‌وری در سطح نرم‌افزاری رسیده‌اند. وقتی بهینه‌سازی کد دیگر پاسخ نمی‌دهد، تنها راه پیش روی غول‌های AI، بازطراحی فیزیکی مسیر حرکت الکتریسیته و داده است تا گلوگاه‌های حافظه برطرف شود.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.