
درون استراتژی AISI برای راستیآزمایی مدلهای هوش مصنوعی پیشرو
مؤسسه ایمنی هوش مصنوعی بریتانیا (AISI) برای تبدیل نتایج ارزیابی مدلهای پیشرو به حقایق علمی قابل راستیآزمایی، زیرساخت باز EvalEval را پذیرفت. این اقدام دادههای سطح تراکنش را…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۸۷ مقاله منتشر شده

مؤسسه ایمنی هوش مصنوعی بریتانیا (AISI) برای تبدیل نتایج ارزیابی مدلهای پیشرو به حقایق علمی قابل راستیآزمایی، زیرساخت باز EvalEval را پذیرفت. این اقدام دادههای سطح تراکنش را…

شرکت آنتروپیک مدل Opus 5.5 را با عملکرد برتر در کدنویسی و کاهش قیمت توکنهای خروجی عرضه کرد. این مدل در حالی منتشر شد که مدیرعامل شرکت بر لزوم توازن میان سرعت پیشرفت قابلیتها و…

یک متدولوژی جدید بر پایه عاملهای هوش مصنوعی و محکزنی تکرارشونده، مدلهای زبانی را قادر ساخت کدهایی در زبان Rust بنویسند که از کتابخانههای پیشرفته انسانی سریعتر است. این رویکرد…

یک گردشکار جدید پیشنهاد میدهد که استنتاج هوش مصنوعی در ابر نباید مسیر پیشفرض باشد، بلکه باید تنها به عنوان یک «سرریز» برای تسکهای سنگین عمل کند. این سیستم با ایجاد یک گیت…

ارزیابیهای سنتی هوش مصنوعی بهدلیل تغییر همزمان وزنهای مدل، پرامپتها و منطق داور شکست میخورند. ذخیره خروجیهای خام در قالب Snapshotهای منجمد، امکان جداسازی دقیق عامل ایجاد…

یک پژوهشگر امنیتی با فریب دادن هوش مصنوعی Muse متعلق به متا، موفق شد کل سیستمفایل ریشه (root filesystem) این مدل را استخراج کند. این نشت دادهها، جزئیات حساس معماری حافظه،…

استارتاپ استخراج سیارک AstroForge مدل Solo را برای مدیریت خودگردان فضاپیماها معرفی کرد. این شرکت قصد دارد در سال ۲۰۲۷ مأموریتی را بدون ارتباط رادیویی با زمین اجرا کند تا هزینههای…

یک دایرکتوری جدید از ۳۳ پروژه بررسیشده، نقشه راهی برای جایگزینی تولید متن باز با تصمیمات محدود و تایپشده در مدل TypeSafe Jev ارائه میدهد. این مجموعه فاصله میان دموهای تبلیغاتی…

مرسدس بنز و Wayve برای ادغام یک سیستم رانندگی مبتنی بر هوش مصنوعی در خودروهای آینده قرارداد بستند. این فناوری امکان رانندگی نقطه-به-نقطه در شهر و بزرگراه را بدون نیاز به نقشههای…

ابتکار Precure با همکاری مایو کلینیک و ترمو فیشر، یکی از بزرگترین پروژههای مولکولی تاریخ را برای توالییابی یک میلیون نمونه انسانی آغاز کرده است. این پروژه با ترکیب سختافزار…

شرکت Snorkel AI با جذب ۳۵۰ میلیون دلار سرمایه، رویکرد خود را از برچسبگذاری ساده به تولید دادههای تخصصی و پیچیده تغییر داد. این شرکت اکنون با استفاده از یک پلتفرم عاملمحور،…

سیسکو ابزار متنباز CAIRN را برای شناسایی بدافزارهای عاملمحور معرفی کرد که بهجای تحلیل کد، روی متادادهها تمرکز دارد. نخستین یافته این ابزار، بدافزار CLOSEDQUORUM است که برای…