اگر امروز برای سرویسهای هوش مصنوعی هزینه میپردازید، احتمالاً بهزودی با پاسخهایی آنیتر و ارزانتر روبهرو میشوید. تراشه Jalapeño (هالاپینو) میتواند توکنهای بیشتری را در هر ثانیه به کاربر برساند و در هر کیلووات برق، بازدهی بالاتری نسبت به پیشرفتهترین پردازندههای فعلی داشته باشد.
طبق گزارش تککرانچ (TechCrunch) در ۲۵ اوت ۲۰۲۶، این سیستم در محک Semianalysis InferenceX پیشرفت عملکردی «بسیار قابلتوجهی» را ثبت کرده است.
این حرکت سختافزاری در حالی رخ میدهد که آزمایشگاههای هوش مصنوعی برای کاهش هزینههای سرسامآور انرژی در سرویسدهی به مدلهای بزرگ رقابت میکنند. همانطور که در تحلیل قبلی ما دربارهی سازگاری نرمافزاری APIهای مختلف اشاره کردیم، بهینهسازی در سطح کد گام اول بود؛ اما حالا OpenAI برای اینکه مدلهایش سریعتر و ارزانتر اجرا شوند، مستقیماً به سراغ لایهی سیلیکون رفته است.
این تراشه با همکاری شرکت برادکام (Broadcom) و با رویکرد «پشته کامل» (Full-stack) طراحی شده است؛ یعنی تراشه، حافظه و مدلها بهصورت هماهنگ با هم ساخته شدهاند تا مثل یک تیم ورزشی حرفهای، هر بخش دقیقاً بداند چه زمانی باید پاس را به بخش دیگر بدهد. جزئیات فنی این بهینهسازی شامل موارد زیر است:
- کاهش گلوگاهها: هدفگیری مستقیم تأخیرها در مراحل پیشپُرکردن (Prefill) و ارتباطات.
- مدیریت وضعیت محلی: نگه داشتن KV Cache — که شبیه به یک دفترچه یادداشت سریع برای مدل است تا مجبور نباشد هر بار همه چیز را از اول بخواند — در نزدیکی هسته پردازش برای کم کردن جابهجایی دادهها.
- محاسبات بهینه: فعالسازی ترکیبات خاصی از شبکه و حافظه برای هر مرحله از استنتاج (Inference) — یعنی همان لحظهای که مدل واقعاً جواب تولید میکند، شبیه به خودِ آشپزی بعد از تمام شدن دورهی آموزش.
ریچارد هو، مدیر سختافزار OpenAI، تأکید کرد که بنچمارکهای فعلی، Jalapeño را در برابر سیستم انویدیا بلکول (Nvidia Blackwell) میسنجند. با این حال، احتمالاً تا زمان استقرار کامل این تراشهها، فضای رقابتی بازار تغییر خواهد کرد.
برای کاربران تجاری، این یعنی آیندهای که در آن پاسخهای هوش مصنوعی تقریباً لحظهای هستند و هزینههای عملیاتی کاهش مییابد. OpenAI با مالکیت سختافزار، میتواند از هر وات برق، بیشترین عملکرد را بیرون بکشد و کف قیمتی محصولات هوش مصنوعی در مقیاس بالا را پایین بیاورد. این استراتژی سختافزاری میتواند زیرساخت لازم برای محصولات فیزیکی آینده را فراهم کند، مشابه آنچه در طرح OpenAI برای عرضه بلندگوی هوشمند جهت حضور فیزیکی ChatGPT مشاهده میکنیم.
به نقل از مستندات داخلی، OpenAI قصد دارد Jalapeño را تا پایان سال ۲۰۲۶ در حجم بسیار کم و از سال ۲۰۲۷ در مقیاس گسترده مستقر کند.
گام بعدی شما
- اگر مدیر محصول هستید، کاهش هزینهی استنتاج را در بودجههای سال ۲۰۲۷ خود پیشبینی کنید.
- تغییر استراتژی OpenAI از «مشتری انویدیا» به «رقیب انویدیا» را دنبال کنید.
- بررسی کنید که آیا مدلهای آیندهی OpenAI قابلیتهای جدیدی در پاسخدهی آنی (Real-time) خواهند داشت یا خیر.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است؛ برای درک رقابت تراشهها، به تحلیل ما دربارهی معماری Blackwell مراجعه کنید.




گفتگو