
Multiverse Computing: کاهش ۱۵.۶ برابری مصرف VRAM در تقطیر مدلها
شرکت Multiverse Computing با معرفی یک سیستم کشینگ آفلاین و تابع زیان جدید، نیاز به حافظه VRAM برای تقطیر مدلهای بزرگ را بهشدت کاهش داد. این دستاورد اجازه میدهد فرآیند…
موضوع
روشی برای آموزش مدلهای هوش مصنوعی با استفاده از چندین پردازنده یا سرور بهصورت همزمان
۶۵ مقاله منتشر شده

شرکت Multiverse Computing با معرفی یک سیستم کشینگ آفلاین و تابع زیان جدید، نیاز به حافظه VRAM برای تقطیر مدلهای بزرگ را بهشدت کاهش داد. این دستاورد اجازه میدهد فرآیند…

پروژه Lumabri با توزیع وزنها و محاسبات میان گرههای Peer-to-Peer، اجرای مدلهای غولپیکر ترکیب خبرهها را بدون نیاز به GPU ممکن کرده است. این سیستم خروجیهای کاملاً یکسانی را روی…

یک راهنمای فنی عمیق، نحوه پیادهسازی پسانتشار، بهینهساز AdamW و آموزش با دقت ترکیبی را با استفاده از HIP/C++ شرح میدهد. این مستند ابزارهای سطح پایین GPU را برای عبور از…

شرکت بایتدنس در حال آموزش مدل عظیمی با ۱۰ تریلیون پارامتر است تا جایگاه خود را در برابر سیستمهای پیشرو غربی تثبیت کند. این پروژه با هدف رسیدن به توانمندیهای مدل Mythos 5…

رویکرد جدید مدلسازی اکتشافی (XM) با انتقال پیچیدگی از مرحله استنتاج به چرخه آموزش، مشکل «تاری مود» را حل کرده است. این تکنیک امکان تولید خروجیهای دقیق در یک گام را فراهم میکند…

کرسور (Cursor) کتابخانه متنباز Mixture-of-Kittens (MoK) را برای رفع گلوگاههای ارتباطی در مدلهای ترکیب خبرهها معرفی کرد. این ابزار با حذف همگامسازی CPU-GPU در سختافزار…

مقیاسگذاری عاملهای هوش مصنوعی در خوشههای توزیعشده معمولاً منجر به تضاد در وضعیت (State) و خطاهای Race Condition میشود. استفاده از ساختارهای دادهای CRDT و رویکرد Event…

شرکت AMD مدل Instella-MoE-16B-A3B را معرفی کرد؛ مدل زبانی مبتنی بر ترکیب خبرهها که کاملاً روی سختافزارهای Instinct آموزش دیده است. این مدل در بنچمارکهای استدلالی و پایه، اکثر…

انویدیا با ترکیب هستههای گرافیکی ادغامشده و دقت ۸ بیتی (FP8)، حافظه و تأخیر آموزش مدلهای زبانی بزرگ را بهشدت کاهش داد. این رویکرد سختافزار-آگاه، جایگزینی بهینه برای…

دسترسی به پردازندههای Blackwell-based B300 از طریق اجاره ابری، هزینههای هنگفت سختافزاری اولیه را برای توسعهدهندگان حذف میکند. این راهنما فرآیند استقرار، از انتخاب زیرساخت تا…

یک چارچوب جدید به نام یادگیری فعال حافظهمحفوظ (PPAL) امکان آموزش مدلهای هوش مصنوعی را بدون اشتراکگذاری دادههای خام بین کشورهای مختلف فراهم میکند. این سیستم با ترکیب یادگیری…

محدودیت رشد هوش مصنوعی از کیفیت مدلها به بهرهوری سختافزار تغییر یافته است. سازمانها اکنون بهجای خرید سختافزار بیشتر، بر لایههای ارکستراسیون برای جلوگیری از بیکار ماندن…