
«مستندات برای ماشینها»؛ شرط لازم برای ارتقای عملکرد عاملها
یک چارچوب جدید ارزیابی معرفی شده است که بهجای تمرکز صرف بر پاسخ نهایی، مسیر و کارایی عاملهای هوش مصنوعی در استفاده از ابزارها را میسنجد. این رویکرد نشان میدهد که برای موفقیت…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۶۹ مقاله منتشر شده

یک چارچوب جدید ارزیابی معرفی شده است که بهجای تمرکز صرف بر پاسخ نهایی، مسیر و کارایی عاملهای هوش مصنوعی در استفاده از ابزارها را میسنجد. این رویکرد نشان میدهد که برای موفقیت…

ساخت عاملهای هوشمند اکنون بیش از آنکه به مهندسی پرامپت وابسته باشد، نیازمند مدیریت «حلقهٔ عامل» (Agent Loop) است. این معماری با کنترل اجرای ابزارها و حفظ وضعیت، مانع از فراموشی…

پروژهی متنباز Network-AI با معرفی یک لایهی هماهنگی، مشکل «بازنویسی خاموش» را در سامانههای چندعاملی حل کرد. این ابزار بهجای نوشتن مستقیم در حافظه، از یک چرخهٔ تأیید استفاده…

سه چارچوب جدید برای رفع گلوگاه حافظه در مدلهای زبانی با پنجره متنی بلند معرفی شدند. این روشها از طریق فشردهسازی حافظه KV Cache، امکان اجرای مدلهای حجیم با سختافزار محدودتر را…

نسخه ۱.۴ ویرایش اجتماعی JuiceFS با حذف گلوگاههای عملیاتی در مجموعهدادههای حجیم AI، سرعت حذف فایلها را تا ۹۳ برابر افزایش داد. این بهروزرسانی از طریق عملیات دستهای متادیتا و…

برنامه PII GUI با اجرای مدلهای ONNX روی دستگاه، اطلاعات حساس را بدون نیاز به ابر شناسایی و حذف میکند. این ابزار با حذف وابستگی به APIهای خارجی، امنیت دادههای شخصی در فایلهای…

ابزار متنباز klaussy-agents نیاز به مدیریت دستی فایلهای پیکربندی برای دستیارهای مختلف کدنویسی را حذف میکند. این ابزار یک مجموعه واحد از دستورالعملهای پروژه را به فرمتهای بومی…

OpenAI با معرفی محک LifeSciBench نشان داد که حتی پیشرفتهترین مدلهای تخصصی زیستشناسی در مواجهه با مسائل پیچیده پژوهشی ناتواناند. این دادهها حاکی از شکاف عمیق میان حفظ اطلاعات…

گروه مشورتی اکوسیستم x86 مشخصات فنی ACE را برای بهینهسازی بارهای کاری یادگیری ماشین معرفی کرد. این استاندارد با ادغام ثباتهای کاشی (Tile Registers) و بردارهای AVX، سرعت ضرب…

یک توسعهدهنده با پیادهسازی رویدادهای ارسالی سرور (SSE) و کشینگ برداری، تأخیر ۱۰ ثانیهای پاسخهای هوش مصنوعی را حذف کرد. این متدولوژی تأخیر ۳۰٪ از پرسوجوها را به نزدیکی صفر…

رمزنگاری بهتنهایی نمیتواند جلوی حملات لایهٔ فیزیکی مثل کور کردن آشکارسازها با لیزر را بگیرد. معماری جریان اطلاعات (IFA) با تفکیک تحلیل هوش مصنوعی از قدرت اجرایی سختافزار، مانع…

شرکت انتروپیک پروتکل زمینه مدل (MCP) را معرفی کرد تا نیاز به نوشتن کدهای رابط جداگانه برای هر ابزار یا پایگاه داده را از بین ببرد. این استاندارد مانند یک رابط جهانی عمل میکند تا…