پرش به محتوای اصلی

موضوع

آموزش توزیع‌شده

روشی برای آموزش مدل‌های هوش مصنوعی با استفاده از چندین پردازنده یا سرور به‌صورت همزمان

۷۳ مقاله منتشر شده

نقشه راه پروژه تپستری: گسترش همکاری هوش مصنوعی با ویتنام و هند

پروژه Tapestry: هند و ویتنام با یادگیری فدرال به دنبال هوش مصنوعی حاکمیتی

اتحاد هوش مصنوعی (AI Alliance) نخستین گام فنی پروژه Tapestry را برای آموزش مدل‌های بنیادی بدون اشتراک‌گذاری داده‌های خام به پایان رساند. هند و ویتنام اکنون از این زیرساخت برای…

۵ دقیقه خواندن۱
بنجامین زایتلن در حال ارائه روش شافل خارج از حافظه با RapidsMPF
آموزش کاربردی

درون سازوکار RapidsMPF برای حل بحران حافظه در پردازش‌های عظیم

کتابخانه RapidsMPF انویدیا با حل مشکل حافظه در تحلیل داده‌های توزیع‌شده، امکان جابه‌جایی حجم عظیم داده‌ها را بدون توقف سیستم فراهم می‌کند. این ابزار با مدیریت هوشمند حافظه میزبان،…

۱۵ دقیقه خواندن
شبکه TauGrid مایکروسافت: پلتفرم متن‌باز مدیریت بارهای کاری GPU در Kubernetes
آموزش کاربردی

مایکروسافت با متن‌باز کردن TauGrid پیچیدگی‌های مدیریت GPU در کوبرنتیز را حذف کرد

مایکروسافت ابزار TauGrid را تحت لایسنس MIT منتشر کرد تا مدیریت صف‌بندی و نظارت بر GPUها را در محیط کوبرنتیز یکپارچه کند. این پشتهٔ نرم‌افزاری نیاز تیم‌های پلتفرم به ترکیب دستی…

۴ دقیقه خواندن۲
سیستم ذخیره‌سازی OceanStor M900 حافظه زمینه‌ای پتابایتی را برای ابررایانه‌های SuperPoD هوآوی فراهم می‌کند.

خوشهٔ OceanStor M900 هواوی ۶۴ پتابایت حافظه برای استنتاج هوش مصنوعی فراهم کرد

هواوی با معرفی OceanStor M900، گلوگاه حافظه در عامل‌های هوش مصنوعی با پنجره‌های متنی بسیار بلند را حل کرد. این سامانه با ارائه حافظه مشترک در مقیاس پتابایت، تأخیر دسترسی را ۹۰٪…

۴ دقیقه خواندن۲
بهینه‌سازی زمان آموزش مدل‌های زبانی بزرگ: راهکارها و تکنیک‌های کاربردی
آموزش کاربردی

گزارش Oxlo.ai: بهینه‌سازی تنظیمات GPU مانع اتلاف منابع محاسباتی می‌شود

یک عامل مشاور جدید با استفاده از پلتفرم Oxlo.ai، تنظیمات سخت‌افزاری آموزش مدل‌های زبانی را ممیزی می‌کند تا از اتلاف منابع GPU جلوگیری کند. این ابزار با شناسایی گلوگاه‌ها در اندازه…

۴ دقیقه خواندن۳
کروزو قرارداد چندساله برای تأمین قدرت پردازش آموزش و استنتاج پرپلکسیتی امضا کرد

انتقال Perplexity به Crusoe چه تأثیری بر سرعت استنتاج مدل‌ها دارد؟

پراپلکسیتی تمام چرخه حیات مدل‌های خود را به ابر Crusoe منتقل کرد تا با استفاده از خوشه‌های GB300 انویدیا، سرعت پاسخ‌دهی را برای میلیون‌ها کاربر افزایش دهد. این همکاری بر کاهش…

۴ دقیقه خواندن۲
بهینه‌سازی موقعیت مکانی حافظه پنهان KV: از صفحه‌بندی تا ذخیره‌سازی لایه‌ای

پلتفرم FX100 توان عملیاتی استنتاج مدل‌های زبانی را ۴۰٪ افزایش داد

شرکت Mingxin با معرفی معماری ذخیره‌سازی لایه‌ای برای KV Cache، گلوگاه حافظه در مدل‌های با زمینه بلند را برطرف کرد. این رویکرد در مدل‌های ۴۸۰ میلیارد پارامتری، زمان تا نخستین توکن…

۵ دقیقه خواندن
یادگیری بازنمایی فدراسیونی پراکنده برای ماموریت‌های نقشه‌برداری زمین‌شناسی سیاره‌ای با قابلیت پایش اخلاقی
آموزش کاربردی

پژوهش SFRL: کاهش ۷۳ درصدی ترافیک ارتباطی در شبکه‌های سیاره‌ای

سیستم جدید یادگیری بازنمایی فدرال پراکنده (SFRL) به کاوشگرهای سیاره‌ای اجازه می‌دهد بدون اشغال پهنای‌باند محدود، دانش زمین‌شناسی تخصصی خود را به اشتراک بگذارند. این رویکرد با…

۹ دقیقه خواندن