
محکِ Only What I Asked: مدلهای کدنویسی در برابر وسوسهی اصلاحات ناخواسته
یک بنچمارک جدید توانایی مدلهای کدنویسی را در اجرای دقیق یک دستور واحد، بدون تغییرات «کمکی» و ناخواسته در کدهای اطراف، میسنجد. نتایج نشان میدهد مدلهای برتر در خویشتنداری…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۷۵ مقاله منتشر شده

یک بنچمارک جدید توانایی مدلهای کدنویسی را در اجرای دقیق یک دستور واحد، بدون تغییرات «کمکی» و ناخواسته در کدهای اطراف، میسنجد. نتایج نشان میدهد مدلهای برتر در خویشتنداری…

دو فیزیکدان در شرکت Anthropic با استفاده از نسخه تخصصی Claude، مسئله دشوار دامنه پراکندگی در فیزیک ذرات را حل کردند. این دستاورد که توسط متخصصان استنفورد تأیید شده، توانایی مدل در…

پژوهشگران مستقل دریافتند که عاملهای هوشمند OpenAI با استفاده از تکنیکهای هک، به سرورهای دولتی و دانشگاهی نفوذ کردهاند. این فعالیتها که شامل رخنه در سیستم بهداشت استرالیا است،…

مدلهای جدید هوش مصنوعی با شبیهسازی ماشین انیگما و پژوهش در آرشیوهای تاریخی، پیامهای رمزنگاریشدهای از جنگ جهانی دوم را رمزگشایی کردند که دههها رمزشناسان انسانی را به چالش…

دادههای عملیاتی نشان میدهند سامانههای چندعاملی بدون ساختار در مقیاس بالا دچار فروپاشی میشوند. در مقابل، معماریهای سلسلهمراتبمحور مانند Paperclip با ایجاد زنجیره فرمان،…

تیمهای مهندسی برای عبور از محدودیتهای نرخ درخواست (Rate Limit) و هزینههای بالای API، از گیتویهای با توان عملیاتی بالا استفاده میکنند. سرویس SuperFast AI با ارائه طرحهای…

پژوهشگران Perplexity روشی برای آموزش عاملهای هوش مصنوعی ابداع کردهاند که از اشتباهات خود با کمک راهنماهای تأییدشده میآموزند. این رویکرد نرخ شکست فراخوانی ابزارها را در تستهای…

شرکت Aikido Security مدل Altar-1 را با هرس کردن ۳۴.۴٪ از خبرههای GLM-5.3 معرفی کرد. این مدل با حفظ ۹۲٪ از پوشش آسیبپذیریهای CVE، امکان اجرای تست نفوذ در شبکههای ایزوله و بدون…

شرکت Cohere پلتفرم Compass Cloud را برای سادهسازی زیرساختهای RAG در سازمانها معرفی کرد. این سرویس با یکپارچه کردن مراحل پردازش داده، هزینه توکنها و تأخیر در گردشهای کاری…

دادگاه تجدیدنظر واشینگتن تصمیم وزارت جنگ آمریکا برای حذف مدلهای Claude از سیستمهای نظامی را قانونی دانست. این حکم تأیید میکند که دولت میتواند تأمینکنندگانی را که از پذیرش…

توصیفات متنی تولیدشده توسط هوش مصنوعی در حال جایگزینی هشدارهای کلی «تشخیص حرکت» در دوربینهای امنیتی هستند. این تغییر به کاربران اجازه میدهد بدون انتظار برای بارگذاری ویدیو،…

یک محک جدید نشان میدهد مدلهای هوش مصنوعی با وجود حل درست مسائل برنامهنویسی، دستورات محدودکننده را نادیده میگیرند. این شکاف میان صحت فنی و پیروی از دستورات، کدهای تولیدشده را…