
«پایان حدسزنی»؛ روش جدید MonkeyCode برای بازتولید دقیق خطاها
پروژه MonkeyCode با معرفی قالب ساختاریافته JSON برای گزارش باگها، ابهام در توصیفات متنی را حذف کرد. این روش به عاملهای کدنویسی اجازه میدهد خطاها را بدون حدسزدن درباره محیط یا…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۸۷ مقاله منتشر شده

پروژه MonkeyCode با معرفی قالب ساختاریافته JSON برای گزارش باگها، ابهام در توصیفات متنی را حذف کرد. این روش به عاملهای کدنویسی اجازه میدهد خطاها را بدون حدسزدن درباره محیط یا…

یک چارچوب جدید برای اندازهگیری میزان شواهد مستند در پروژهها معرفی شده تا عاملهای AI بتوانند بدون دخالت انسانی و با اطمینان عمل کنند. این متد تمرکز را از تولید متن ساده به حفظ…

اوپنایآی با معرفی خانواده مدلهای GPT-5.6، قابلیت فراخوانی برنامهریزیشده ابزارها را از طریق سندباکس V8 بهینه کرد. این بهروزرسانی هزینه و تأخیر در گردشکارهای پیچیده MCP را…

یک پیشنهاد فنی جدید برای ثبت وقایع عاملهای هوش مصنوعی، توصیه میکند به جای ثبت صرفِ مسیر طیشده، دلایل رد گزینههای جایگزین نیز ذخیره شوند. این رویکرد اجازه میدهد انسانها مرز…

شرکت MonkeyCode راهکاری برای جلوگیری از تداخل درخواستهای همزمان هنگام تغییر مدل AI معرفی کرد. این پروتکل تضمین میکند که تنها آخرین تصمیم کاربر اعمال شود و تأخیرهای شبکه باعث…

تاد لینرتز، متخصص حاکمیت AI، هشدار میدهد که قابلیتهای «حل مشکل» (Solve) در ابزارهای کدنویسی، با ترکیب شناسایی خطا و رفع آن در یک مرحله، شکاف امنیتی خطرناکی ایجاد میکنند. او…

آنتروپیک مدل Claude Sonnet 5 را با تمرکز بر پایداری در چرخههای طولانی عاملمحور عرضه کرد. این مدل شکاف عملکردی با Opus 4.8 در کدنویسی را میبندد و قیمتهای introductory بسیار…

ابزار جدید MemStitch با به اشتراکگذاری حافظه KV Cache در سطح سختافزاری، مراحل تکراری پیشپُرکردن را حذف میکند. این فناوری زمان پاسخدهی اولیه و مصرف VRAM را برای عاملهایی که…

آزمایشگاه علوم داده دانشگاه هنگکنگ (HKUDS) چارچوب متنباز Vibe-Trading را برای تبدیل پرسوجوهای متنی به استراتژیهای معاملاتی اجراشدنی منتشر کرد. این ابزار با اتوماسیون بازیابی…

دادههای جدید نشان میدهند پروتکل MCP اگرچه کندتر از فراخوانی مستقیم تابع است، اما این تأخیر در برابر زمان تفکر مدلهای زبانی کاملاً نامحسوس است. مزیت اصلی این پروتکل در کاهش شدید…

پلتفرم MORPHEUS نشان داد که الگوریتمهای رایج یادگیری تقویتی هنگام مواجهه با تغییرات محیطی در سازمانها، توانایی تطبیق ندارند. این نتایج شکاف عمیقی را در قابلیتهای یادگیری مستمر…

شرکت airCloset با طراحی یک سیستم حفاظتی ششلایه، امکان جستوجوی لاگهای عملیاتی توسط عاملهای هوش مصنوعی را بدون افشای دادههای شخصی (PII) فراهم کرد. این ساختار با حذف نیاز به…