
رویکرد «میز قتل»؛ چرا هوش مصنوعی در شکار باگهای امنیتی شکست میخورد؟
مطالعه موردی روی Ory Kratos نشان میدهد که هوش مصنوعی در تولید فرضیات امنیتی موفق است اما در شناسایی باگهای واقعی ناتوان است. راهکار جایگزین، استفاده از AI برای ایجاد حدسهای…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۷۶ مقاله منتشر شده

مطالعه موردی روی Ory Kratos نشان میدهد که هوش مصنوعی در تولید فرضیات امنیتی موفق است اما در شناسایی باگهای واقعی ناتوان است. راهکار جایگزین، استفاده از AI برای ایجاد حدسهای…

گزارش جدید Wafer نشان میدهد پردازنده MI355X ایامدی در مقیاس صنعتی، نسبت عملکرد به قیمت بسیار بهتری نسبت به Blackwell B200 انویدیا دارد. این برتری از طریق بهینهسازیهای دقیق در…

پژوهشگران دانشگاه کلمبیا مداری عصبی کشف کردند که به مغز اجازه میدهد بهسرعت بین کارهای مختلف جابهجا شود. این یافته نشان میدهد نورونهای بازدارنده که خودِ نورونهای بازدارنده…

شرکت Mistral مدل وزنباز Leanstral 1.5 را برای تخصص در اثباتهای ریاضی و تأیید رسمی کد معرفی کرد. این مدل با بهرهگیری از یک گردشکار عاملمحور، رکوردهای جدیدی در سطح دکترا ثبت…

یک چارچوب جدید با ترکیب یادگیری بازنمایی پراکنده و یادگیری فدرال، پیشبینی دقیق خرابی در رباتهای نرم را ممکن کرد. این سامانه با محلی نگاه داشتن دادهها، نرخ دقت ۹۴ درصدی را با…

یک تجربه نزدیک به فاجعه در مواجهه با حمله تزریق پرامپت، شکاف امنیتی خطرناکی را در عاملهای کدنویسی خودگردان آشکار کرد. برخلاف چتباتها، این عاملها به دلیل دسترسی به سیستم فایل و…

ناپایداری در کنترل هزینههای ابزارهای عاملمحور میتواند منجر به «حملات منع سرویس مالی» شود. تحلیلهای جدید پیشنهاد میکنند سد بودجه از لایهٔ اجرا به لایهٔ دروازه (Gateway) منتقل…

معیارهای سنتی پایش عملکرد دیگر برای عیبیابی مدلهای زبانی کافی نیستند. ردیابی دقیق تعداد توکنها و تأخیر ایجاد شده توسط حفاظهای امنیتی، تنها راه جلوگیری از جهش ناگهانی هزینههای…

ابزار متنباز mcpsnoop مانند Wireshark برای پروتکل MCP عمل میکند و امکان نظارت زنده بر ترافیک JSON-RPC بین کلاینتها و سرورهای هوش مصنوعی را فراهم میکند. این ابزار شکاف دید را…

پراکسی محلی جدیدی به نام pxpipe با تبدیل متون حجیم به تصاویر، هزینههای ورودی مدلهای Claude را بهشدت کاهش میدهد. این روش از هزینه ثابت توکنهای تصویری برای انتقال حجم زیادی از…

شرکت Anthropic برای جلوگیری از تقطیر مدل توسط شرکتهای چینی، محدودیتهای شدیدی را اعمال کرده است. با این حال، غولهایی مثل ByteDance با استفاده از VPN و شرکتهای واسطه، این…

تحلیلی از Agentics نشان میدهد که فراهم کردن دسترسی به متن جلسات پیشین (Session Transcripts)، هیچ اثر مثبتی بر عملکرد عاملهای کدنویسی ندارد. این رویکرد به دلیل ایجاد «انحراف در…