پرش به محتوای اصلی

موضوع

ادغام مدل‌ها

ترکیب چند مدل یادگیری ماشین برای بهره‌گیری از قابلیت‌های هر یک

۶ مقاله منتشر شده

لنگرها حفظ مطالب را بیست‌وهشت برابر افزایش می‌دهند
آموزش کاربردی

آیا لنگرهای داده‌ای جایگزینی کارآمد برای Fine-Tuning در مدل‌های زبانی هستند؟

یک متد جدید با ترکیب لنگرهای داده‌ای و به‌روزرسانی‌های ادغام‌شدهٔ LoRA، مانع از فراموشی فاجعه‌بار در مدل‌های زبانی بزرگ می‌شود. این رویکرد نرخ حفظ دانش در ۱۰۰ تکلیف مختلف را از…

۲ دقیقه خواندن
ریاضیدانان روس به مدل‌های هوش مصنوعی آموختند بدون کلام با هم گفتگو کنند

تبادل وزن‌ها در برابر تبادل متن؛ روشی ارزان‌تر برای اتصال مدل‌های AI

استارتاپ Mostik روشی را ابداع کرده که مدل‌های هوش مصنوعی به‌جای تبادل متن، از طریق مقادیر ریاضی وزن‌ها با یکدیگر ارتباط برقرار کنند. این تکنیک به مدل‌های کوچک اجازه می‌دهد هوشمندی…

۴ دقیقه خواندن۲
موتور تکاملی VIDRAFT: چگونه مدل ۳۶ میلیارد پارامتری، غول‌های ۳۹۷ میلیاردی را به چالش کشید
آموزش کاربردی

Darwin-36B در برابر مدل‌های غول‌پیکر؛ پیروزی بازترکیب تکاملی بر حجم داده

مدل جدید Darwin-36B-Opus توانست در یکی از سخت‌ترین محک‌های استدلال، با مدلی ۱۱ برابر بزرگ‌تر برابری کند. این دستاورد به‌جای آموزش سنگین با GPU، از طریق یک فرآیند تکاملی برای ترکیب…

۴ دقیقه خواندن۱
چرا ادغام تک‌مرحله‌ای مدل‌های زبانی در وظایف تخصصی شکست می‌خورد؟

چرا ادغام تک‌مرحله‌ای مدل‌های زبانی در وظایف تخصصی شکست می‌خورد؟

پژوهشگران متد METIS را برای حل مشکل «پاک‌شدن اطلاعات» در ادغام مدل‌ها معرفی کردند. این روش با جایگزینی تجمیع یک‌باره با یک پروتکل تکرارشونده، مانع از تداخل وظایف شده و عملکرد…

۱ دقیقه خواندن۲