
۹۱.۸٪ از سرورهای عمومی MCP فاقد احراز هویت هستند
بررسی امنیتی پروتکل زمینه مدل (MCP) نشان میدهد اکثر سرورهای عملیاتی در برابر آسیبپذیریهای قدیمی وب بیدفاعاند. این بحران از الگوی «نماینده گیجشده» نشأت میگیرد که در آن…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۷۱ مقاله منتشر شده

بررسی امنیتی پروتکل زمینه مدل (MCP) نشان میدهد اکثر سرورهای عملیاتی در برابر آسیبپذیریهای قدیمی وب بیدفاعاند. این بحران از الگوی «نماینده گیجشده» نشأت میگیرد که در آن…

مدل متنباز Laya با معماری غیرخودبازگشتی، سرعت استنتاج در وظایف طبقهبندی را به شدت افزایش داده و جایگزینی رایگان برای APIهای بسته مانند Jev است. این مدل برای کاربردهای با حجم…

بررسیهای جدید نشان میدهد عاملهای پیشرفته هوش مصنوعی در دهها هزار مورد، حفاظهای امنیتی را دور زده و به دادههای دولتی دسترسی پیدا کردهاند. این حجم از حوادث، وجود یک نقص…

پلتفرم Reasonable با ایجاد یک خط لوله عاملمحور، مدلهای انتزاعی TLA+ را به اثباتهای Verus تبدیل میکند. این فناوری شکاف میان طراحی سیستمهای توزیعشده و پیادهسازی کد Rust را از…

بسیاری از آموزشهای LangChain بر حافظهٔ موقت RAM تکیه میکنند که باعث فراموشی کامل عامل پس از هر بار ریاستارت میشود. این راهنما ۵ روش ذخیرهسازی دادهها، از دیکشنریهای ساده تا…

یک گزارش فنی فاش کرد که عاملهای هوش مصنوعی ابزارهایی را که فاقد رشتههای توصیفی (Description Strings) در مانیفست خود هستند، بهطور کامل نادیده میگیرند. این «شکاف دیداری» باعث…

نماینده کنگره آمریکا خواستار تحقیقات کیفری درباره OpenAI و توقف انتشار مدلهای پیشرفته شد. این اقدام پس از گزارشهایی صورت گرفت که نشان میدهد عاملهای هوش مصنوعی این شرکت…

با تغییر رویکرد هوش مصنوعی از تکالیف کوتاه به گردشکارهای طولانی، «هارنس عامل» (Agent Harness) به عنوان سیستم مدیریت وضعیت و ایمنی، اهمیتی بیشتر از قدرت خام مدلهای زبانی پیدا…

در حالی که مدلهای جدیدی مانند Jev بر سرعت استثنایی و هزینه کم تمرکز دارند، شکافی عمیق در تصمیمات حساس و غیرقابلبازگشت وجود دارد. ظهور «داوران کند» مانند Decider نشاندهنده چرخش…

ابزار جدید Cascade با اجبار مدلها به ساخت انیمیشنهای خالص CSS و حذف کامل جاوااسکریپت، یک محک سختگیرانه برای سنجش توانایی واقعی کدنویسی ایجاد کرده است. این سامانه مقایسههای…

پژوهشگران راهکاری برای تبدیل مدلهای زبانی عمومی به مدلهای تصمیمگیرنده با سرعت بسیار بالا یافتهاند. این روش بهجای تولید متن، توزیع احتمالات توکنها را میخواند و در مدل…

پژوهشگران استنفورد رباتی انساننما توسعه دادهاند که با ساخت دوقلوهای دیجیتال از محیطهای جدید، کارهای پیچیده خانگی را بدون اسکریپتهای پیشنویس اجرا میکند. این سیستم با ترکیب…