
چرا مدلهای زبانی در مواجهه با سناریوهای حساس به زمان شکست میخورند؟
محک جدید GPTNT نشان داد که هیچ مدل زبانی بزرگی، اعم از متنباز یا تجاری، قادر به مدیریت همکاریهای آنی تحت فشار نیست. این آزمایش شکافی بحرانی در توانایی مدلها برای مدیریت عدم…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۹۴ مقاله منتشر شده

محک جدید GPTNT نشان داد که هیچ مدل زبانی بزرگی، اعم از متنباز یا تجاری، قادر به مدیریت همکاریهای آنی تحت فشار نیست. این آزمایش شکافی بحرانی در توانایی مدلها برای مدیریت عدم…

انویدیا با معرفی مدل وزنباز Nemotron-Labs-TwoTower، رمزگشایی متوالی توکنها را با فرآیند انتشار موازی جایگزین کرد. این مدل در حالی توان عملیاتی تولید را بیش از دو برابر افزایش…

گزارشهای استاندارد OpenTelemetry تنها اجرای ابزار را ثبت میکنند و قادر به تشخیص عدم مجوز (Authorization) نیستند. ابزار جدید authz_gate.py نشان میدهد بسیاری از اقدامات غیرمجاز…

یافتههای جدید Inithouse نشان میدهد عاملهایی که بهجای متنهای طولانی، خروجیهای عددی و احتمالی میدهند، نرخ تعامل بالاتری دارند. این رویکرد با ایجاد نقاط مقایسهی دقیق، قابلیت…

تیمی از توسعهدهندگان برای عبور از محدودیت کلیدهای API استاتیک، یک گیتوی مرکزی را برای مدیریت احراز هویت ۱۲ سرور پروتکل زمینه مدل (MCP) پیادهسازی کردند. این معماری پیچیدگیهای…

ابزارهای جدید هوش مصنوعی از تحلیل لحظهای کدها به سمت تحلیل تاریخچه کامل Git و بحثهای PR حرکت کردهاند. این «هوش مخزنمحور» با درک دلیل تصمیمات گذشته، سرعت توسعه در سیستمهای…

پژوهشی جدید نشان میدهد تعامد (Orthogonalization) ماتریس حافظه در مدلهای mLSTM، توانایی بازیابی اطلاعات در محیطهای نویزی را بهشدت افزایش میدهد. این تکنیک مانع از حذف خاطرات…

تحلیل جدید هزینهها نشان میدهد که روش دستهبندی (Batching) میتواند مخارج API را تا ۴۰٪ کاهش دهد، هرچند تأخیر را افزایش میدهد. در مقابل، استریمینگ حس انتظار را ۳۰ تا ۵۰ درصد کم…

آنتروپیک و گوگل دیپمایند با معرفی مدلهای فوقسریع، رقابت را از «هوش» به «سرعت» تغییر دادند. مدل Sonnet 5 بر استدلال آنی تمرکز دارد و DiffusionGemma تولید تصویر با وزنهای باز را…

پلتفرم SibFly با ارائه یک API جدید، دسترسی عاملهای هوش مصنوعی به دادههای واقعی نشست زمین ماهوارههای ناسا را ممکن کرد. اکنون توسعهدهندگان میتوانند با ادغام این ابزار در…

تبدیل مدلهای زبانی از حالت پاسخدهنده به عاملهای خودکار، نیازمند افزودن لایههای ساختاری برای حافظه، استدلال و دسترسی به ابزارها است. این معماری به توسعهدهندگان اجازه میدهد…

دولت آمریکا پس از توافق با شرکت Anthropic، دسترسی کاربران خارجی به قدرتمندترین مدلهای هوش مصنوعی این شرکت را بازگشت. این تصمیم به پایان یک بازهٔ محدودکننده برای مدلهای Fable 5 و…