پرش به محتوای اصلی

موضوع

آموزش توزیع‌شده

روشی برای آموزش مدل‌های هوش مصنوعی با استفاده از چندین پردازنده یا سرور به‌صورت همزمان

۴۶ مقاله منتشر شده

مقالات برتر هوش مصنوعی در هاگینگ فیس - ۲۶ ژوئیه ۲۰۲۶

۳ مقاله از Hugging Face برای ارتقای استدلال عامل‌ها و زیرساخت LLM

پژوهش‌های تازه در Hugging Face مدل‌های خود-اصلاح‌گر و روش‌های آموزش DeepSeek-V4 روی سخت‌افزارهای غیرانویدیا را معرفی کردند. این پیشرفت‌ها شکاف‌های حیاتی در خودمختاری عامل‌های هوش…

۳ دقیقه خواندن
آموزش توزیع‌شده تک‌کنترلر PyTorch Monarch روی GPUهای AMD با ROCm
آموزش کاربردی

درون سازوکار همگام‌سازی گره‌های جایگزین در زیرساخت‌های PyTorch

پای‌تورتچ با انتقال Runtime Monarch به پردازنده‌های AMD، امکان بازیابی خودکار آموزش‌های توزیع‌شده پس از خرابی گره‌ها را فراهم کرد. این سیستم اجازه می‌دهد پردازنده‌های سالم به کار…

۸ دقیقه خواندن
قرارداد ۵ میلیارد دلاری Anthropic با AMD برای تأمین ۲ گیگاوات GPU جهت اجرای Claude
اخبار کوتاه روزانه

سرمایه‌گذاری ۵ میلیارد دلاری AMD برای تامین برق ۲ گیگاواتی کلود

شرکت AMD با سرمایه‌گذاری ۵ میلیارد دلاری، خوشه‌ای عظیم از پردازنده‌های گرافیکی MI450 را در اختیار Anthropic قرار می‌دهد. این توافق با هدف شکستن انحصار انویدیا و تامین زیرساخت لازم…

۱ دقیقه خواندن
استارتاپ چیپ هوش مصنوعی Etched با ارزش ۱۰.۳ میلیارد دلار سرمایه جذب کرد
اخبار کوتاه روزانه

ارزش Etched به ۱۰.۳ میلیارد دلار رسید؛ به چالش کشیدن انویدیا با سخت‌افزار تخصصی

استارت‌آپ سخت‌افزاری Etched با جذب ۳۰۰ میلیون دلار سرمایه در راند Series C، ارزش خود را در هفت ماه به ۱۰.۳ میلیارد دلار رساند. این شرکت با طراحی تراشه‌هایی که صرفاً برای استنتاج…

۵ دقیقه خواندن
برگ برگ چای LLVM AMD GFX1250: تعبیر نشانه‌های پردازنده گرافیکی آینده AMD

تغییر معماری MI455X؛ افزایش رجیسترهای VGPR برای تقابل با Blackwell

تحلیل کدهای LLVM از معماری جدید شتاب‌دهنده‌های سری MI400 شرکت AMD پرده برداشت. مدل MI455X با افزایش چشمگیر تخصیص رجیستر و یکپارچه‌سازی حافظهٔ کش، قصد دارد کارایی استنتاج مدل‌های…

۱۳ دقیقه خواندن
تنظیم دقیق مدل‌های ویدیویی و تصویری در مقیاس بزرگ با NVIDIA NeMo Automodel و 🤗 Diffusers
آموزش کاربردی

چطور NeMo Automodel محدودیت‌های مقیاس‌پذیری در مدل‌های پخش را برطرف می‌کند؟

کتابخانه NeMo Automodel با ادغام در Diffusers، امکان تنظیم دقیق مدل‌های عظیم تصویر و ویدیو را بدون نیاز به تبدیل فرمت وزن‌ها فراهم کرد. این ابزار آموزش توزیع‌شده در مقیاس صنعتی را…

۸ دقیقه خواندن
هسته‌های توجه پراکنده برای تسریع آموزش میلیون‌توکن با Flash-MSA
آموزش کاربردی

Flash-MSA هزینه آموزش مدل‌های میلیون‌توکنی را با هسته‌های پراکنده کاهش داد

پیاده‌سازی متن‌باز جدیدی از توجه پراکنده Minimax (MSA)، آموزش مدل‌ها با پنجره‌های متنی میلیونی را روی GPUهای Hopper و Blackwell ممکن کرد. این ابزار با استفاده از پراکندگی بلوکی و…

۹ دقیقه خواندن