
خوشههای AMD Strix Halo تأخیر استنتاج را به ۵ میکروثانیه رساندند
یک راهنمای فنی جدید نشان میدهد چگونه اتصال دو پردازنده AMD Strix Halo با استفاده از RoCE v2، تأخیر همگامسازی را از ۷۰ میکروثانیه به ۵ میکروثانیه کاهش میدهد. این پیکربندی با دور…
موضوع
روشی برای آموزش مدلهای هوش مصنوعی با استفاده از چندین پردازنده یا سرور بهصورت همزمان
۷۳ مقاله منتشر شده

یک راهنمای فنی جدید نشان میدهد چگونه اتصال دو پردازنده AMD Strix Halo با استفاده از RoCE v2، تأخیر همگامسازی را از ۷۰ میکروثانیه به ۵ میکروثانیه کاهش میدهد. این پیکربندی با دور…

مقیاسپذیری هوش مصنوعی از یک چالش نرمافزاری به یک بحران زیرساختی تبدیل شده است. مدلهای مدرن برای جلوگیری از اتلاف منابع محاسباتی گرانقیمت، به خوشههای GPU تخصصی و سیستمهای…

یک سیستم جدید مبتنی بر یادگیری نمایش فدرال پراکنده (SFRL)، با ادغام عاملهای هوش مصنوعی تجسمیافته، مسیرهای تخلیه را در لحظه بهینه میکند. این معماری با کاهش ۸۵ درصدی پهنای باند…

استارتآپ Netris برای حذف گلوگاههای شبکهای در مراکز دادهٔ کوچک AI، ۱۵ میلیون دلار سرمایه جذب کرد. این شرکت بهجای استفاده از هوش مصنوعی، از الگوریتمهای شتابیافته سختافزاری…

شرکت Krea مدل Krea 2 را با ۱۲.۹ میلیارد پارامتر منتشر کرد که از نظر کیفیت با مدلهای بستهٔ پیشرو رقابت میکند. این عرضه شامل یک مدل پایه برای تنظیم دقیق و یک نسخه Turbo برای…

شرکت Cursor با همکاری SpaceX در حال آموزش یک مدل بنیادی اختصاصی است تا وابستگی خود به مدلهای شخص ثالث را به کلی حذف کند. این استراتژی با معرفی Origin (پلتفرم Git برای عاملها) و…

شرکت Prime Intellect چارچوب متنباز prime-rl 0.6.0 را برای یادگیری تقویتی مدلهای ترکیب خبرهها (MoE) با مقیاس تریلیون پارامتر منتشر کرد. این سیستم با جداسازی زیرساخت آموزش و…

یک چارچوب جدید برای ریزشبکههای کشاورزی هوشمند با ترکیب یادگیری فعال و یادگیری فدرال، انتقال دادهها را به شدت کاهش داده است. این سامانه بدون نیاز به ارسال دادههای خام به ابر،…

استراتژی جدید توصیهگر در Adobe Commerce با ترکیب دادههای رفتاری و شباهت محصولات، عملکرد سیستمهای قاعدهمند سنتی را به چالش کشیده است. این معماری توزیعشده امکان مدیریت نزدیک به…

نسخه ۱.۴ ویرایش اجتماعی JuiceFS با حذف گلوگاههای عملیاتی در مجموعهدادههای حجیم AI، سرعت حذف فایلها را تا ۹۳ برابر افزایش داد. این بهروزرسانی از طریق عملیات دستهای متادیتا و…

سیستم Piper با جداسازی استراتژیهای آموزش از پیادهسازی زمان اجرا، پیچیدگیهای موازیسازی مدلهای عظیم را کاهش میدهد. این سیستم از یک نمایش میانی (IR) مبتنی بر گراف برای اجرای…

پژوهشگران الگوریتم GASLoC را برای پیشآموزش غیرمتمرکز مدلهای زبانی معرفی کردهاند که گلوگاههای ارتباطی همگام را حذف میکند. این چارچوب بهویژه در محیطهایی با سختافزارهای متنوع…