پرش به محتوای اصلی
پرش به محتوای مقاله

شتاب‌دهنده CS-4 سروسراس: ۴۴۰۰ توکن در ثانیه با افزایش سرعت کلاک

·۲ شهریور ۱۴۰۵۱ دقیقه مطالعه
سیستم CS-4 سربرس با دو برابر عملکرد روی یک تراشه یکسان رونمایی شد
سیستم CS-4 سربرس با دو برابر عملکرد روی یک تراشه یکسان رونمایی شد
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

دو برابر شدن عملکرد از طریق افزایش سرعت کلاک و خنک‌کنندگی در مقیاس رک، به‌جای تکیه بر بهبودهای معماری ترانزیستور یا بهینه‌سازی مدل.

تصور کنید یک مدل زبانی بزرگ را اجرا می‌کنید و پاسخ‌ها به‌جای جاری شدن، با سرعتی باورنکردنی در کسری از ثانیه ظاهر می‌شوند. هر کاربر اکنون می‌تواند ۴۴۰۰ توکن (Token) — تکه‌های کوچکی از متن، مثل برش‌های یک کیک طولانی که مدل تکه‌تکه می‌خورد — را در هر ثانیه از یک رک واحد Cerebras CS-4 دریافت کند.

به نقل از گزارش وب‌سایت the-decoder.com در ۲۴ اوت ۲۰۲۶، این جهش عملکردی، CS-4 را به سریع‌ترین سیستم در کلاس خود تبدیل کرده است. در حالی که اکثر سخت‌افزارهای هوش مصنوعی روی کوچک‌تر کردن ترانزیستورها تمرکز دارند، سروسراس روی گسترش ابعاد فیزیکی شرط‌بندی کرده است. این محصول یک سیستم در مقیاس رک است؛ یعنی به‌صورت یک کابینت کامل سرور با محاسبات، برق و سیستم خنک‌کننده یکپارچه عرضه می‌شود. این رویکرد در واقع تکامل همان معماری ویفری در برابر GPU است که برای حذف گلوگاه‌های ارتباطی AI طراحی شده است.

همان‌طور که در تحلیل‌های قبلی ما درباره‌ی معماری‌های غیرمتعارف سخت‌افزاری اشاره کردیم، این رویکرد به سیستم اجازه می‌دهد سخت‌افزار را بسیار شدیدتر از خوشه‌های سنتی GPU تحت فشار قرار دهد. طبق مستندات فنی، مشخصات CS-4 به شرح زیر است:

  • چیپ‌ست: بهره‌گیری از موتور مقیاس-ویفری WSE-3 با فناوری ۵ نانومتری.
  • ظرفیت: سه ویفر در هر رک (در مقایسه با دو ویفر در CS-3).
  • حافظه: ۴۴ گیگابایت برای هر ویفر.
  • معماری: طراحی ماژولار جدید «Backpack» برای سرعت بخشیدن به مونتاژ.

بر اساس اعلام سروسراس، این شرکت برای رسیدن به دو برابر عملکرد نسل قبلی، سرعت کلاک را از طریق سیستم‌های تغذیه قدرتمند و خنک‌کنندگی پیشرفته افزایش داده است. همچنین استنتاج مجزا (Disaggregated Inference) از طریق شرکایی مانند AMD و AWS Trainium معرفی شده است.

این تغییر برای مدیران کسب‌وکار به معنای حرکت به سمت سخت‌افزارهای تخصصی و عظیم برای استنتاج (Inference) — لحظه‌ای که مدل واقعاً جواب تولید می‌کند، شبیه خودِ آشپزی و نه دوره‌ی آموزش آشپز — با توان عملیاتی بالا است. این تحول در سخت‌افزار، بخشی از رکن‌های تبدیل سریع ایده‌ها به محصول در معماری‌های جدید هوش مصنوعی است که اجرای عملیات را از چت‌های ساده به سمت کاربردهای پیچیده‌تر می‌برد. اگرچه تحلیلگران SemiAnalysis معتقدند دستاوردهای شبکه‌ای این سیستم حداقلی است، اما سرعت خام آن برای شرکت‌هایی مثل OpenAI که از سخت‌افزار سروسراس برای Codex Spark استفاده می‌کند، حیاتی است.

گام بعدی شما

  • بررسی بنچمارک‌های فنی در کنفرانس Hot Chips برای تایید ادعاهای سرعت.
  • تحلیل هزینه-به-عملکرد CS-4 در مقایسه با H100 انویدیا برای استقرار مدل‌های عظیم.
  • رصد همکاری‌های سروسراس با AWS برای دسترسی ابری به این سخت‌افزار.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است؛ اثر این معماری بر کاهش تأخیر در مدل‌های استدلالی را در گزارش بعدی بررسی خواهیم کرد.

چرا این موضوع مهم است؟

این پیشرفت بر اساس تخصص در طراحی ویفرهای عظیم (Wafer-Scale) رخ داده و وابستگی صنعت به GPUهای انویدیا را در بخش استنتاج کمرنگ می‌کند. دسترسی به چنین سرعتی، تجربه کاربر نهایی را از «انتظار برای پاسخ» به «تعامل آنی» تغییر می‌دهد.

تأثیر برای ایران

به‌دلیل ماهیت سخت‌افزاری و قیمت بسیار بالای این سیستم‌ها، دسترسی مستقیم برای مراکز داده ایرانی ناممکن است و اثر آن تنها از طریق سرویس‌های ابری (در صورت رفع محدودیت‌ها) حس خواهد شد.

·نگاه ما
تحریریه دات‌هوش

سروسراس با نادیده گرفتن ترند کوچک‌سازی و تمرکز بر «مقیاس فیزیکی»، عملاً تعریف سخت‌افزار استنتاج را تغییر داد. این استراتژی نشان می‌دهد که برای رسیدن به سرعت‌های فوق‌سریع، شاید راهکار نه در بهینه‌سازی نرم‌افزاری، بلکه در بازگشت به سخت‌افزارهای غول‌پیکر و سیستم‌های خنک‌کننده صنعتی باشد.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.