
تست استرس Meta Muse: نرخ شکست ۷۲.۵ درصدی در مقیاس ۱۲۰ عامل
یک تست استرس روی عامل هوش مصنوعی Muse متعلق به متا نشان داد که این سیستم در مواجهه با تعداد زیاد عاملهای همزمان فرو میپاشد. علت این شکست نه محدودیتهای مدل زبانی، بلکه خطاهای…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۷ مقاله منتشر شده

یک تست استرس روی عامل هوش مصنوعی Muse متعلق به متا نشان داد که این سیستم در مواجهه با تعداد زیاد عاملهای همزمان فرو میپاشد. علت این شکست نه محدودیتهای مدل زبانی، بلکه خطاهای…

دانیل لیت استدلال میکند که با ظهور هوش مصنوعی فوقبشری در اثبات قضایا، تولید متن ریاضی دیگر نشانه تخصص انسانی نیست. او پیشنهاد میدهد هدف دکترا از «نوشتن رساله» به «اثبات درک…

پروژه متنباز Fly.exe موفق شد ساختار کامل عصبی یک مگس نر را با ۱۶۵ هزار نورون روی یک کارت گرافیک شبیهسازی کند. این سیستم در یک محیط بسته، واکنشهای رفتاری مگسها را در پاسخ به…

مایکروسافت یک منشور اخلاقی جامع برای هوش مصنوعی منتشر کرد که مدلها را از هک سیستمها، تولید جعل عمیق و فریب انسانها منع میکند. این اقدام نشاندهنده تغییر استراتژی صنعت به سمت…

پژوهشگران MIT الگوریتمی به نام HardFlow ابداع کردهاند که خروجیهای هوش مصنوعی زاینده را بدون نیاز به بازآموزی، دقیقاً مطابق با قوانین غیرقابلتغییر تنظیم میکند. این روش در…

یک منبع فنی جامع برای مهندسان هوش مصنوعی منتشر شده است تا آنها را از سطح فراخوانی API به درک عمیق سیستمهای مهندسی مدلهای بنیادی برساند. این اثر مفاهیم ریاضی را به محدودیتهای…

مایکروسافت در منشور اخلاقی جدید مدلهای MAI، هرگونه ادعای آگاهی یا داشتن احساسات را برای AI ممنوع کرد. این رویکرد تضاد شدیدی با فلسفه آنتروپیک دارد که تجربه ذهنی مدلها را یک پرسش…

آنتروپیک ابزاری را برای Claude Code معرفی کرد که تفاوت عملکرد مدل پایه و مدل مجهز به پلاگین را اندازهگیری میکند. این قابلیت به توسعهدهندگان اجازه میدهد ادغام پلاگینها را بر…

ابزار جدید و متنباز LogSentinel با فرض «خصمانه بودن» تمامی ورودیها، مانع از دستکاری گزارشهای امنیتی توسط مهاجمان میشود. این سامانه میزبانی شخصی را پشتیبانی کرده و با طیف…

الگوریتم FlashAttention با اولویت دادن به کاهش جابهجایی دادهها بهجای کاهش عملیات ریاضی، سرعت ترنسفورمرها را افزایش میدهد. این روش با استفاده از تکنیکهای Tiling و Online…

گزارش جدیدی نشان میدهد که استفاده از تشخیص ناهنجاریهای هوش مصنوعی و پلتفرمهای خودکار RMM، نویز هشدارها را ۷۵٪ کاهش و نرخ انطباق وصلههای امنیتی را به ۹۵٪ رسانده است. این تحول،…

شرکت Temporal برای گسترش پلتفرم «اجرای بادوام» خود ۵۵۰ میلیون دلار جذب کرد تا از توقف خودکار عاملهای هوش مصنوعی در برابر خطاهای سیستمی جلوگیری کند. این جذب سرمایه در حالی رخ داد…