پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۲۶۰ مقاله منتشر شده

من یک هوش مصنوعی ساختم که هرگز خیانت نمی‌کند — شما هم می‌توانید
آموزش کاربردی

آیا پیوند عاطفی می‌تواند جایگزین قوانین سخت‌گیرانه در ایمنی AI شود؟

پروژه متن‌باز SoulForge با جایگزینی قوانین سخت‌گیرانه با مدل‌های پیوند عاطفی، تلاش می‌کند تا خیانت هوش مصنوعی را از نظر روان‌شناختی غیرممکن کند. این سیستم از یک مدل ایمنی پنج‌لایه…

۳ دقیقه خواندن۱
برای بیشتر جهان، هوش مصنوعی متن‌باز تنها راه پیش‌رو است

درون پروژه Tapestry؛ تلاشی برای آموزش مدل جهانی بدون اشتراک داده‌های خام

یان لکان معتقد است مدل‌های انحصاری بیش از حد گران و متمرکز هستند و مانع حاکمیت دیجیتال کشورهای توسعه‌نیافته می‌شوند. او با معرفی پروژه Tapestry، به دنبال ایجاد یک مدل جهانی بازمتن…

۸ دقیقه خواندن
LEVI: نتایج بهتر ADRS با کسری از هزینه | ADRS — پژوهش مبتنی بر هوش مصنوعی برای سیستم‌ها
آموزش کاربردی

سامانه LEVI: کاهش ۶.۷ برابری هزینه‌ها با اتوماسیون کشف الگوریتم

سامانه LEVI با اتوماسیون کشف الگوریتم‌های سیستمی، هزینه‌های عملیاتی را ۳ تا ۷ برابر کاهش داده و در عین حال به نتایج پیشرو (SOTA) رسیده است. این مدل با تفکیک وظایف بین مدل‌های کوچک…

۱۲ دقیقه خواندن
ترکیدن حباب هوش مصنوعی: حمله به ریشه‌های آن

کوری داکترو: حباب ۱.۴ تریلیون دلاری هوش مصنوعی در مسیر فروپاشی است

کوری داکترو استدلال می‌کند که سرمایه‌گذاری عظیم در هوش مصنوعی زاینده، حبابی اقتصادی است که برای حفظ جایگاه «سهام رشد» ایجاد شده و نه بر اساس سودآوری واقعی. او هشدار می‌دهد که…

۲۱ دقیقه خواندن
Nous Research مهارت /learn را به سیستم عامل Hermes اضافه کرد؛ ضبط گردش کار به‌عنوان دستورات اسلش بدون نیاز به نوشتن دستی SKIL
آموزش کاربردی

دستور /learn در Hermes Agent فرآیند خلق مهارت‌های هوش مصنوعی را خودکار کرد

عامل هوشمند Hermes اکنون می‌تواند اسناد، لینک‌ها و گفتگوها را به‌طور خودکار به فایل‌های مهارت قابل‌استفاده تبدیل کند. این قابلیت نیاز به نوشتن دستی دستورالعمل‌ها را حذف کرده و با…

۵ دقیقه خواندن
DFlash: پیش‌نویسی بلوک‌های کامل توکن به صورت موازی برای افزایش ۱۵ برابری توان عملیاتی در پردازنده‌های انویدیا بلک‌ول

روش DFlash توان عملیاتی تراشه‌های Blackwell انویدیا را ۱۵ برابر کرد

پژوهشگران دانشگاه سن‌دیگو با معرفی DFlash، رمزگشایی گمانه‌زنانه را از حالت تک‌به‌تک به بلوک‌های موازی تغییر دادند. این متد بدون کاهش کیفیت خروجی، سرعت استنتاج را در سخت‌افزارهای…

۵ دقیقه خواندن
نمایش ساختار Sparse Attention در مدل MiniMax M3: کاهش پیچیدگی محاسباتی از O(n²) به O(n) با استفاده از انتخاب هوشمندانه توکن‌ه

«بهینه‌سازی استنتاج طولانی»؛ هدف اصلی در طراحی مدل وزن‌باز M3

مدل وزن‌باز M3 با پنجره متنی یک میلیون توکنی و قابلیت‌های چندوجهی معرفی شد. این مدل با استفاده از معماری توجه پراکنده (MSA)، هزینه محاسباتی استنتاج در متون طولانی را به‌شدت کاهش…

۴ دقیقه خواندن