
سرعت تولید در برابر کیفیت پوشش: تضادِ AI در Fuzzing
یک بررسی عملی نشان میدهد که مدلهای زبانی با وجود سرعت بالا در پیشنهاد ورودیهای تست، بدون یک سیستم نظارت سختگیرانه، خروجیهای بیفایده تولید میکنند. از ۸۷ بذر پیشنهادی برای یک…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۶ مقاله منتشر شده

یک بررسی عملی نشان میدهد که مدلهای زبانی با وجود سرعت بالا در پیشنهاد ورودیهای تست، بدون یک سیستم نظارت سختگیرانه، خروجیهای بیفایده تولید میکنند. از ۸۷ بذر پیشنهادی برای یک…

یک اصلاح کد خودکار توسط GitHub Copilot باعث ایجاد حفرهٔ امنیتی تزریق اسکریپت در مخزن Snowflake شد. این نقص توسط عامل Red Agent شرکت Wiz شناسایی و در عرض ۵ روز برای نفوذ به…

شرکت Gravis Robotics با جذب ۲۰۰ میلیون دلار از سافتبنک، سیستمهای ارتقای هوشمند را برای تجهیز ماشینآلات ساختمانی قدیمی به قابلیتهای خودران گسترش میدهد. این رویکرد به…

پژوهشگران دریافتند که مدلهای بینایی-زبانی (VLM) را میتوان تنها با تغییر رنگ کلمات، به نتایج مثبت یا منفی سوق داد، حتی اگر متن هیچ تغییری نکند. این آسیبپذیری ریسک امنیتی شدیدی…

استفاده از APIهای سازگار با OpenAI باعث سادهسازی ادغام مدلها شده اما تفاوتهای عملیاتی در بودجه توکنها و هزینههای چندوجهی را پنهان میکند. کنترلکننده پذیرش (Admission…

اجرای محلی Cloudflare OS با استفاده از Ollama نشان داد که محدودیتهای پیشفرض پنجره متنی باعث حذف خاموش پرامپتهای سیستمی میشود. این نقص فنی منجر به ایجاد حلقههای تکرار…

یک استقرار گسترده از عاملهای کوتاهمدت هوش مصنوعی با استفاده از پروتکل Git، مشکل تکرار وظایف و «طوفان تصمیمگیری» را حل کرده است. این سیستم بهجای قفلهای سنتی، از سوابق خوانای…

بهینهسازی سیستمهای RAG برای نرخ پاسخدهی بالا، منجر به تولید پاسخهای متقاعدکننده اما نادرست در محیط عملیاتی میشود. یک برنامه هوش مصنوعی قابلاعتماد باید اولویت را از «روانی…

دیپسیک چارچوب متنباز DeepSeek Harness (dsh) را برای ساخت عاملهای هوش مصنوعی معرفی کرد که در آن مدلها، ابزارها و حلقههای کنترلی بهصورت پلاگینهای قابل تعویض هستند. این سیستم…

پلتفرم AgentForge با جایگزینی چتهای متنی با قراردادهای سختگیرانه JSON، از فروپاشی سیستمهای چندعاملی جلوگیری میکند. این لایهٔ نظارتی مانع از توقف خط تولید داده به دلیل توهمات…

بسیاری از عاملهای هوش مصنوعی بهدلیل ساختار خطی در مواجهه با وظایف پیچیده شکست میخورند. انتقال به معماری حلقوی به این عاملها اجازه میدهد بهصورت خودکار استدلال کنند، خروجیها…

استاندارد جدید llms.txt با ارائه نقشههای سایت مبتنی بر مارکداون، جایگزین ساختارهای پیچیده HTML برای خزندههای AI شده است. این اقدام باعث کاهش مصرف توکن و افزایش دقت ارجاعات در…