
«تراکم دادهها» کلید برتری مدلهای کوچک بر مدلهای عظیم
تحلیل قوانین مقیاسپذیری نشان میدهد تعادل بین حجم داده و تعداد پارامترها بسیار مؤثرتر از افزایش صرف پارامترها است. یافتههای مطالعهٔ Chinchilla ثابت کرد مدلهای کوچکتر که بهطور…
موضوع
روشی برای آموزش مدلهای هوش مصنوعی با استفاده از چندین پردازنده یا سرور بهصورت همزمان
۶۵ مقاله منتشر شده

تحلیل قوانین مقیاسپذیری نشان میدهد تعادل بین حجم داده و تعداد پارامترها بسیار مؤثرتر از افزایش صرف پارامترها است. یافتههای مطالعهٔ Chinchilla ثابت کرد مدلهای کوچکتر که بهطور…

یادگیری فدرال با جایگزینی اشتراکگذاری پارامترهای ریاضی بهجای سوابق خام بیماران، همکاری بیمارستانها در آموزش مدلها را ممکن میکند. این روش محدودیتهای قانونی حریم خصوصی را دور…

یک سامانه جدید یادگیری بازنمایی فدرال پراکنده، امکان آموزش مدلهای هوش مصنوعی را بر روی میکروکنترلرهای کمتوان فراهم کرده است. این روش با کاهش ۹۲ درصدی حجم دادههای ارسالی، عمر…

بسیاری از شکستهای مقیاسپذیری در هوش مصنوعی ناشی از معماری مدلها نیست، بلکه به دلیل ناهماهنگی در سیستمهای توزیعشده و زمانبندی GPUهاست. مشکلاتی نظیر تکهتکه شدن حافظه در…

یک راهنمای فنی جدید نشان میدهد چگونه اتصال دو پردازنده AMD Strix Halo با استفاده از RoCE v2، تأخیر همگامسازی را از ۷۰ میکروثانیه به ۵ میکروثانیه کاهش میدهد. این پیکربندی با دور…

مقیاسپذیری هوش مصنوعی از یک چالش نرمافزاری به یک بحران زیرساختی تبدیل شده است. مدلهای مدرن برای جلوگیری از اتلاف منابع محاسباتی گرانقیمت، به خوشههای GPU تخصصی و سیستمهای…

یک سیستم جدید مبتنی بر یادگیری نمایش فدرال پراکنده (SFRL)، با ادغام عاملهای هوش مصنوعی تجسمیافته، مسیرهای تخلیه را در لحظه بهینه میکند. این معماری با کاهش ۸۵ درصدی پهنای باند…

استارتآپ Netris برای حذف گلوگاههای شبکهای در مراکز دادهٔ کوچک AI، ۱۵ میلیون دلار سرمایه جذب کرد. این شرکت بهجای استفاده از هوش مصنوعی، از الگوریتمهای شتابیافته سختافزاری…

شرکت Krea مدل Krea 2 را با ۱۲.۹ میلیارد پارامتر منتشر کرد که از نظر کیفیت با مدلهای بستهٔ پیشرو رقابت میکند. این عرضه شامل یک مدل پایه برای تنظیم دقیق و یک نسخه Turbo برای…

شرکت Cursor با همکاری SpaceX در حال آموزش یک مدل بنیادی اختصاصی است تا وابستگی خود به مدلهای شخص ثالث را به کلی حذف کند. این استراتژی با معرفی Origin (پلتفرم Git برای عاملها) و…

شرکت Prime Intellect چارچوب متنباز prime-rl 0.6.0 را برای یادگیری تقویتی مدلهای ترکیب خبرهها (MoE) با مقیاس تریلیون پارامتر منتشر کرد. این سیستم با جداسازی زیرساخت آموزش و…

یک چارچوب جدید برای ریزشبکههای کشاورزی هوشمند با ترکیب یادگیری فعال و یادگیری فدرال، انتقال دادهها را به شدت کاهش داده است. این سامانه بدون نیاز به ارسال دادههای خام به ابر،…