
سامانه LEVI: کاهش ۶.۷ برابری هزینهها با اتوماسیون کشف الگوریتم
سامانه LEVI با اتوماسیون کشف الگوریتمهای سیستمی، هزینههای عملیاتی را ۳ تا ۷ برابر کاهش داده و در عین حال به نتایج پیشرو (SOTA) رسیده است. این مدل با تفکیک وظایف بین مدلهای کوچک…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۸۶ مقاله منتشر شده

سامانه LEVI با اتوماسیون کشف الگوریتمهای سیستمی، هزینههای عملیاتی را ۳ تا ۷ برابر کاهش داده و در عین حال به نتایج پیشرو (SOTA) رسیده است. این مدل با تفکیک وظایف بین مدلهای کوچک…

بحران تأمین حافظه در مراکز داده باعث جهش قیمت رمهای مدرن و قدیمی شده است. این وضعیت که با کمبود جهانی گاز هلیوم تشدید شده، بازار سختافزار مصرفکننده را به شدت تحت فشار قرار داده…

حملات تزریق پرامپت با گنجاندن دستورات مخرب در ورودیها، مدلهای زبانی را مجبور به نادیده گرفتن قوانین ایمنی میکنند. این آسیبپذیری منجر به نشت دادههای محرمانه و اجرای عملیات…

دولت ایالات متحده از شرکت متا میخواهد مدلهای خود را برای شناسایی نقاط ضعف امنیتی تحویل دهد. متا تنها شرکت بزرگ توسعهدهنده است که هنوز با این درخواستهای داوطلبانه همکاری نکرده…

کالکویل برای خروج از انحصار سختافزاری و ورود به بازار مراکز داده، استارتاپ Modular را نزدیک به ۴ میلیارد دلار خرید. این اقدام هدفش ایجاد پلتفرمی است که اجرای مدلهای هوش مصنوعی…

شرکت OpenAI با همکاری Broadcom از تراشه اختصاصی Jalapeño برای بهینهسازی استنتاج مدلهای زبانی رونمایی کرد. این پردازنده با هدف کاهش هزینههای عملیاتی و افزایش سرعت، برای استقرار…

آزمایشگاه Armorer Labs یک سیستم تأیید لایهای را برای جایگزینی با پرامپتهای خستهکننده «بله/خیر» در عاملهای هوش مصنوعی پیشنهاد داده است. این مدل با طبقهبندی اقدامات بر اساس…

شرکت Mistral AI مدل OCR 4 را برای درک ساختار اسناد معرفی کرد که در تستهای کور، در ۷۲٪ موارد ترجیح داوران را به دست آورده است. این ابزار با ارائه امتیاز اطمینان برای هر کلمه، دقت…

یک سری فنی جدید بررسی میکند که چگونه فرآیند تقطیر، مدلهای غولپیکر و گرانقیمت را به نسخههایی چابک و تخصصی تبدیل میکند. این چرخش راهبردی، تخصص محلی و قابلاعتماد را به…

عامل هوشمند Hermes اکنون میتواند اسناد، لینکها و گفتگوها را بهطور خودکار به فایلهای مهارت قابلاستفاده تبدیل کند. این قابلیت نیاز به نوشتن دستی دستورالعملها را حذف کرده و با…

پژوهشگران دانشگاه سندیگو با معرفی DFlash، رمزگشایی گمانهزنانه را از حالت تکبهتک به بلوکهای موازی تغییر دادند. این متد بدون کاهش کیفیت خروجی، سرعت استنتاج را در سختافزارهای…

یک باگ رایج در پیادهسازی پروتکل زمینه مدل (MCP) باعث میشود خطاهای ۴۰۴ به اشتباه به عنوان شکست سیستمی تلقی شده و دسترسی عاملها به ابزارها را قطع کنند. راهکار این مشکل، تفکیک…