
کتابچه یادگیری تقویتی در گیتهاب؛ پیوند تئوری ریاضی با کدهای PyTorch
یک راهنمای جامع و فشرده برای یادگیری تقویتی (RL) در گیتهاب منتشر شده است که مفاهیم تئوریک را مستقیماً به پیادهسازیهای عملی متصل میکند. این مخزن با ارائه اثباتهای ریاضی و…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۷۱ مقاله منتشر شده

یک راهنمای جامع و فشرده برای یادگیری تقویتی (RL) در گیتهاب منتشر شده است که مفاهیم تئوریک را مستقیماً به پیادهسازیهای عملی متصل میکند. این مخزن با ارائه اثباتهای ریاضی و…

پروژه ReasonGate یک لایه امنیتی بازمتن برای برنامههای مبتنی بر مدلهای زبانی است که حملات تزریق پرامپت و نشت دادهها را از طریق دفاع چندلایه میبندد. برخلاف ابزارهای سنتی، این…

یک الگوی معماری جدید، هوش مصنوعی صوتی را به دو بخش «صفحه رسانه» برای پردازش آنی و «صفحه کسبوکار» برای استدلال تقسیم میکند. این جداسازی مانع از آن میشود که فراخوانیهای کند…

پژوهشگران آنتروپیک «فضای J» (J-space) را شناس کردند؛ خوشهای از الگوهای فعالسازی که مانند یک فضای کاری جهانی عمل کرده و استدلالهای پیچیده مدل را مدیریت میکند. این کشف گامی بزرگ…

یک محک جدید برای جریانهای کاری K8sGPT نشان میدهد که دقت هوش مصنوعی در تشخیص خطاها هنوز برای ایمنی کامل محیط تولید کافی نیست. این پژوهش تأکید میکند که توانایی «اجتناب از اقدام»…

بررسیهای اولیه NTSB نشان میدهد راننده تسلا با فشار کامل پدال گاز، سیستم رانندگی خودکار FSD را دستی غیرفعال کرد و با سرعت ۱۱۷ کیلومتر بر ساعت به یک خانه برخورد کرد. این گزارش…

تمرکز هوش مصنوعی سازمانی از کیفیت مدلها به «لایه هماهنگی» تغییر کرده است. یک معماری ششلایه جدید پیشنهاد شده تا از خطاهای انباشته جلوگیری کرده و نرخ ۴۰ درصدی شکست پروژهها را…

مدل K3 با ۲.۸ تریلیون پارامتر و پنجره متنی یک میلیون توکنی معرفی شد. این مدل در زمینه هوش استدلالی بهطور قابلتوجهی از میانگین مدلهای همرده پیشی گرفته، اما در سرعت تولید خروجی…

پلتفرم Artificial Analysis مجموعهای از محکهای جدید برای ارزیابی گردشهای کاری پیچیده و نرخ توهم در مدلهای پیشرو معرفی کرد. این چارچوبها به جای امتیازات کلی، ارزش اقتصادی واقعی…

یک چارچوب عاملمحور جدید به نام Schema با تبدیل جهان به برنامههای قابل اجرا، مدلهای پیشرو را به کارایی انسانی در حل مسائل پیچیده استدلالی رسانده است. این سیستم با جداسازی فرآیند…

لایه مهندسی زمینه Ratel با استفاده از مکانیزم «افشای تدریجی»، بار توکنهای ورودی را ۸۰٪ کاهش میدهد. این ابزار با تزریق ابزارهای مورد نیاز در لحظه، نیاز به پایگاهدادههای برداری…

مقیاسدهی ناکارآمد مدلهای هوش مصنوعی زاینده باعث جهش قیمت حافظه و سختافزار در سطح جهان شده است. کارشناسان هشدار میدهند که تقاضای شدید منابع ممکن است تا سال ۲۰۲۸ رایانههای…