
استانداردسازی تکرارپذیری در ۲۸ روش بازگشت الگوریتمی با RecourseBench
چارچوب RecourseBench با معرفی یک خط لولهی پنجلایه، امکان ارزیابی سیستماتیک و تکرارپذیر روشهای بازگشت الگوریتمی را فراهم کرده است. این ابزار با اعتبارسنجی ۲۸ متد پیشرو، شکاف…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۶۶ مقاله منتشر شده

چارچوب RecourseBench با معرفی یک خط لولهی پنجلایه، امکان ارزیابی سیستماتیک و تکرارپذیر روشهای بازگشت الگوریتمی را فراهم کرده است. این ابزار با اعتبارسنجی ۲۸ متد پیشرو، شکاف…

مهاجمان با بهرهبرداری از آسیبپذیری «نایب سرگردان» در ربات پشتیبانی متا، ۲۰ هزار حساب اینستاگرام را بدون نیاز به رمز عبور تصاحب کردند. این اتفاق شکاف امنیتی بحرانی در عاملهای…

گوگل کلاد استاندارد Open Knowledge Format (OKF) v0.1 را برای تبدیل دانش پراکنده سازمانی به یک گراف متنی قابل انتقال معرفی کرد. این فرمت با تکیه بر Markdown و YAML، امکان مدیریت…

شرکت Z.ai مدل GLM-5.2 را با پنجره متنی یک میلیون توکنی معرفی کرد تا امکان بارگذاری کامل مخازن کد در حافظه فعال فراهم شود. این مدل با ابزارهایی مثل Claude Code سازگار است و دایرهی…

یک بنچمارک جدید از ۶۰ مدل نشان میدهد که سری Claude در رد پروپاگاندای روسیه پیشتاز است. در مقابل، عملکرد ضعیف Mistral ادعای این شرکت فرانسوی بهعنوان جایگزین اروپایی و قابلاعتماد…

ماهواره YAM-9 با استفاده از مدل Gemma 3 موفق شد برای نخستین بار اهداف زمینی را بدون دخالت انسان در مدار شناسایی کند. این انتقال پردازش به لبه، گلوگاههای ارسال داده را حذف کرده و…

دولت آمریکا مدلهای Fable 5 و Mythos 5 شرکت Anthropic را بهدلیل نگرانیهای امنیتی بهطور جهانی متوقف کرد. شواهد نشان میدهد این تصمیم سختگیرانه نه بر اثر یک نفوذ پیچیده، بلکه…

پژوهشگران راهکاری برای دستیابی به مهارت گرفتن اشیاء بدون استفاده از دوربین ابداع کردهاند که صرفاً بر بازخوردهای لمسی تکیه میکند. این سیستم با استفاده از یک دوقلوی دیجیتال…

مدل BridgeVLM با تبدیل گرافهای علی به توکنهای ساختاریافته، استدلال علی را در مدلهای چندوجهی درونی کرده است. این رویکرد در وظایف پیچیده و خلاف-واقع، بهطور قابلتوجهی از…

افزایش مقیاس مدلهای پیشرو نتوانسته است مشکل بنیادین آموزشهای مبتنی بر هوش مصنوعی، یعنی مدیریت همزمان برنامه درسی و گفتگو را حل کند. یک سیستم جدید با جداسازی مدیریت دانش از لایه…

گردشکار جدیدی به نام ICALens با بهرهگیری از تحلیل مؤلفههای مستقل (ICA)، مسیرهای تفسیری در بازنماییهای مدلهای زبانی را بدون نیاز به آموزش متمرکز و هزینهبر دیکشنریها بازیابی…

پژوهشی جدید نشان میدهد شخصیسازی مدلهای زبانی یک قابلیت واحد نیست، بلکه شکافی میان «سبک رفتاری» و «دقت واقعگرایانه» است. در حالی که LoRA در تقلید از لحن کاربر موفق است، RAG در…