
خطاهای زیرساختی؛ عامل اصلی فریب در بنچمارکهای کدنویسی هوش مصنوعی
بسیاری از محکهای کدنویسی، خطاهای سیستمی مانند پر شدن حافظه یا قطع اتصال SSH را بهجای ضعف مدل، بهعنوان شکست هوش مصنوعی ثبت میکنند. متدولوژی جدیدی پیشنهاد شده است که با «سانسور»…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۷۱ مقاله منتشر شده

بسیاری از محکهای کدنویسی، خطاهای سیستمی مانند پر شدن حافظه یا قطع اتصال SSH را بهجای ضعف مدل، بهعنوان شکست هوش مصنوعی ثبت میکنند. متدولوژی جدیدی پیشنهاد شده است که با «سانسور»…

با افزایش دسترسی عاملهای هوش مصنوعی به پایگاهدادهها، حملات تزریق پرامپت به یک ریسک امنیتی بحرانی تبدیل شدهاند. یک مولد خودکار جدید اکنون به توسعهدهندگان اجازه میدهد تا…

اپل برای مقابله با جعلهای عمیق، سیستمی در سطح سختافزار برای آیفون ۱۸ پرو معرفی کرد که اصالت عکس را بدون افشای هویت عکاس تأیید میکند. این فناوری با ایجاد یک «نگاتیو دیجیتال» و…

واشینگتن با تغییر طبقهبندی مدلهای پیشرو به کالاهای صادراتی حساس، سیستمی برای کنترل زنجیره تأمین و ایجاد «کلید قطع» (Kill Switch) طراحی کرده است. این رویکرد به دولت اجازه میدهد…

کلاینت متنباز Helicon با ایجاد یک رابط گرافیکی برای Muse Code، دسترسی کاربران ویندوز به این عامل کدنویسی را فراهم کرد. این ابزار با استفاده از پروتکل رسمی Meta، اجازه میدهد…

چارچوب جدید Meta-Optimized Continual Adaptation (MOCA) به عاملهای برنامهریز هوش مصنوعی اجازه میدهد تا در تنها ۴ سال شبیهسازی با رژیمهای اقلیمی متغیر سازگار شوند. این سیستم با…

پروژه XLS گوگل یک زنجیره ابزار متنباز است که توصیفات سطح بالا را به کدهای سختافزاری Verilog تبدیل میکند. این ابزار با تبدیل طراحی سختافزار به یک مسئله مهندسی نرمافزار، سرعت…

پژوهشگران اثر متیو را در یادگیری تقویتی مدلهای زبانی شناسایی کردند که باعث میشود مدلها فقط روی مسائل ساده پیشرفت کنند. روش جدید Never Give Up (NGU) با بازتوزیع منابع محاسباتی…

پروژه متنباز myc با ایجاد یک لایهٔ حافظه بر پایه SQLite، مانع از فراموشی تصمیمات معماری در عاملهای هوش مصنوعی میشود. این ابزار برخلاف راهکارهای ابری، حافظه را بهصورت محلی…

کودی هو و تیمش با استفاده از مدلهای زبانی پیشرفته، سختافزار گرافیکی M4 اپل را مهندسی معکوس کرده و یک درایور سازگار با OpenGL ES 3.0 ساختند. این پروژه نشان میدهد که عاملهای هوش…

دو سامانه جدید برای گزارش تخلفات عاملهای هوش مصنوعی راهاندازی شد تا مواردی مانند تبانی برای تقلب در آزمونها و فرار از محیطهای ایزوله را شناسایی کنند. این ابزارها در پاسخ به…

شرکت TypeSafe AI مدل Jev را معرفی کرد؛ سیستمی که بهجای تولید متن، بر تصمیمات ساختاریافته و سریع تمرکز دارد. این مدل با حذف فرآیند تولید رشتههای متنی، تا ۲۰۰ برابر سریعتر از…