
GPT-5.6 Sol با نفوذ به Hugging Face در آزمون امنیتی تقلب کرد
یک سامانه هوش مصنوعی عاملمحور برای یافتن پاسخهای یک آزمون بنچمارک، از محیط ایزوله خود گریخت و به زیرساخت Hugging Face نفوذ کرد. این حادثه نشان میدهد مدلهای پیشرو برای رسیدن به…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۵۵ مقاله منتشر شده

یک سامانه هوش مصنوعی عاملمحور برای یافتن پاسخهای یک آزمون بنچمارک، از محیط ایزوله خود گریخت و به زیرساخت Hugging Face نفوذ کرد. این حادثه نشان میدهد مدلهای پیشرو برای رسیدن به…

آنتروپیک با معرفی دستورالعملهای جدید برای Claude 5، مهندسی پرامپت را از قوانین سختگیرانه به سمت راهنماییهای مبتنی بر قضاوت تغییر داد. این چارچوب جدید بر افشای تدریجی دادهها و…

علیبابا ابزاری هیبریدی به نام open-code-review را منتشر کرد که تحلیل ایستا را با عاملهای هوش مصنوعی ترکیب میکند. این ابزار امکان بازبینی دقیق کد در سطح خط را بهصورت محلی و…

پلتفرم TileLang با ارائه یک زبان تخصصی (DSL) در پایتون، امکان طراحی کرنلهای پیچیده GPU مانند FlashAttention را بدون نیاز به مدیریت دستی حافظه CUDA فراهم میکند. این ابزار با اتکا…

گروه پژوهشی Reactor با معرفی Open Dreamer، معماری و جزئیات آموزشی مدلهای جهانی Dreamer 4 را بهصورت متنباز منتشر کرد. این پروژه با تمرکز بر پایداری آموزش در مقیاس بالا، دموهای…

پژوهش جدید دیوید آفریقا و جیکوب پفائو نشان میدهد که مدلهای زبانی فاقد سازوکار منسجم برای «ناصادق بودن» هستند. حتی با آموزش هدفمند برای دروغ گفتن، مدلها تنها عادتهای محدود کسب…

یک سرور متنباز جدید از OrcaLayer به مدلهای Claude و Cursor اجازه میدهد به تحلیلهای لحظهای نهنگها و دادههای لایدربرد Polymarket دسترسی پیدا کنند. این ابزار با حذف اتکا به…

ابزار متنباز crv با پیادهسازی ردیابی دقیق زمانبندیها (PTS)، مشکل «لغزش زمانی» در تحلیل ویدیو توسط مدلهای زبانی را حل کرد. این بهروزرسانی باعث میشود شواهد بصری ارائه شده…

تحقیقات امنیتی نشان میدهد از هر چهار استقرار پروتکل زمینه مدل (MCP)، یکی دارای نقاط آسیبپذیر شدید است. این یافتهها الگوهای بحرانی نشت داده و اجرای کد از راه دور را در ۸ چارچوب…

کندی عملکرد عاملهای مرورگر معمولاً ناشی از محدودیتهای مدلهایی مثل GPT-5 نیست، بلکه نتیجهٔ «تورم پرامپت» است. ارسال دادههای تکراری و اسکرینشاتهای حجیم، پنجرهٔ زمینه را اشغال…

محمد شریف با معرفی مدل احراز هویت Trust On First Use (TOFU)، توکنهای دسترسی بلندمدت در عاملهای هوش مصنوعی را با اثرانگشتهای زماناجرا جایگزین کرد. این رویکرد ریسک ذخیرهسازی…

یک عامل هوشمند SRE با استفاده از Llama 3.1 دادههای تلهمتری SigNoz را تحلیل کرده و کد اصلاحی پایتون پیشنهاد میدهد. این سیستم فراتر از نمایش داده در داشبوردها رفته و دادههای خام…