
انتقال Perplexity به Crusoe چه تأثیری بر سرعت استنتاج مدلها دارد؟
پراپلکسیتی تمام چرخه حیات مدلهای خود را به ابر Crusoe منتقل کرد تا با استفاده از خوشههای GB300 انویدیا، سرعت پاسخدهی را برای میلیونها کاربر افزایش دهد. این همکاری بر کاهش…
موضوع
روشی برای آموزش مدلهای هوش مصنوعی با استفاده از چندین پردازنده یا سرور بهصورت همزمان
۶۵ مقاله منتشر شده

پراپلکسیتی تمام چرخه حیات مدلهای خود را به ابر Crusoe منتقل کرد تا با استفاده از خوشههای GB300 انویدیا، سرعت پاسخدهی را برای میلیونها کاربر افزایش دهد. این همکاری بر کاهش…

شرکت Mingxin با معرفی معماری ذخیرهسازی لایهای برای KV Cache، گلوگاه حافظه در مدلهای با زمینه بلند را برطرف کرد. این رویکرد در مدلهای ۴۸۰ میلیارد پارامتری، زمان تا نخستین توکن…

سیستم جدید یادگیری بازنمایی فدرال پراکنده (SFRL) به کاوشگرهای سیارهای اجازه میدهد بدون اشغال پهنایباند محدود، دانش زمینشناسی تخصصی خود را به اشتراک بگذارند. این رویکرد با…

آمازون ابزاری متنباز برای خودکارسازی استقرار و مدیریت خوشههای عظیم یادگیری ماشین معرفی کرد. این سامانه با ترکیب EKS و SageMaker HyperPod، پیچیدگیهای زیرساختی را به یک رابط…

شرکت Fireworks AI با معرفی Training API و Fireworks Lab، امکان اجرای حلقههای آموزش سفارشی روی زیرساختهای توزیعشده را فراهم کرد. این پلتفرم از لایههای سازگارساز LoRA و آموزش…

آیبیام خانواده مدلهای استدلالی Granite 4.2 را با وزنهای باز منتشر کرد که بر اساس ۱۵ تریلیون توکن آموزش دیدهاند. این مدلها با استفاده از یک خط لوله یادگیری تقویتی…

آموزش مدلهای عظیم زبانی اغلب بهجای قدرت پردازشی، با محدودیت حافظه GPU متوقف میشود. ZeRO و FSDP با توزیع تکههای مدل در کل خوشه، این گلوگاه حافظه را به یک مسئله مدیریتپذیر در…

پلتفرم رایگان InferQuest با جایگزینی گواهینامههای سنتی با دستاوردهای فنی تأییدشده، مسیر یادگیری مهندسی استنتاج و آموزش مدلهای زبانی را gamify کرده است. این سامانه مهندسان را…

یک توسعهدهنده با هدف سادهسازی فرآیند آموزش مدلها، فریمورک متنباز Tensorless را معرفی کرد. این ابزار با حذف تنظیمات پیچیده و کاهش حجم وابستگیها، مسیر تبدیل دادههای خام به…

انویدیا تأیید کرد که OpenAI از سیستم GB200 NVL72 برای آموزش و استنتاج مدلهای پیشرو استفاده میکند. این تغییر نشاندهنده گذار از تمرکز بر تعداد GPUها به سمت زیرساختهای یکپارچه در…

شرکت Relativity Networks با جذب ۲۲ میلیون دلار سرمایه، فناوری فیبر نوری توخالی را برای انتقال دادهها با سرعت ۳۰٪ بیشتر از شیشههای سنتی عرضه میکند. این پیشرفت به توسعهدهندگان…

یک تخصیصکننده جدید با جایگزینی زمانبندی FIFO، ظرفیتهای بلااستفاده GPU را بازیابی کرده و بهرهوری را در سناریوهای سنگین آموزش ۳۳ درصد بالا برده است. این سیستم با تبدیل تقاضای…