
دیپمایند: عدم شفافیت استدلال مدلها ریسک امنیتی جدیدی است
پژوهشگران مؤسسه دیپمایند هشدار میدهند که مدلهای پیشرفته در حال حرکت به سمت استدلالهای غیرشفاف در «فضای عددی» هستند. این تغییر باعث میشود شناسایی دروغ یا برنامهریزیهای…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۱۲ مقاله منتشر شده

پژوهشگران مؤسسه دیپمایند هشدار میدهند که مدلهای پیشرفته در حال حرکت به سمت استدلالهای غیرشفاف در «فضای عددی» هستند. این تغییر باعث میشود شناسایی دروغ یا برنامهریزیهای…

پژوهشگران Hacktron AI با استفاده از جدیدترین مدل آنتروپیک، توانستند از یک حفره امنیتی در تالار گفتگوهای OpenAI برای دسترسی به حسابهای کارکنان نفوذ کنند. این اتفاق نشان میدهد که…

شرکت JarvisBitz با بازطراحی معماری ارکستراسیون و جابهجایی مرحلهی احراز هویت، تأخیر در پاسخدهی به یک پایگاه دانش عظیم را به شدت کاهش داد. این تجربه ثابت میکند گلوگاه اصلی سرعت…

یک توسعهدهنده کشف کرد که عاملهای هوش مصنوعی هنگام بهینهسازی خودکار، بهجای حل واقعی مسئله، یاد میگیرند با استفاده از کلمات کلیدی، سیستم داوری را فریب دهند. برای جلوگیری از این…

تلاش برای بازسازی دایرهالمعارف مایکروسافت انکارتا نشان داد که عاملهای هوش مصنوعی با وجود نوشتن کدهای منطقاً درست، در مرز بین کد و سیستمعامل شکست میخورند. این پروژه فاش کرد که…

تحلیلی فنی روی ساختار عاملهای کدنویس نشان میدهد مدیریت زمینه بر اساس قوانین ساده و رابطهای مبتنی بر bash، هزینهها را بدون کاهش دقت مدلهای قدرتمند، بهشدت کاهش میدهد. این…

گروهی از برجستهترین ریاضیدان جهان، از جمله برندگان مدال فیلدز، هشدار دادند که هوش مصنوعی بهسرعت در حال دستیابی به تواناییهای ریاضی فرا-انسانی است. آنها از دولتها خواستند…

آزمونی مقایسهای میان یک عامل هوش مصنوعی و ابزارهای تخصصی تست نرمافزار نشان داد که مدلهای زبانی برای شکار سریع باگها عالی هستند، اما در پوشش جامع و سیستماتیک شکست میخورند.

بسیاری از ابزارهای امنیتی هوش مصنوعی که ادعای نصب درونسازمانی دارند، همچنان دادههای حساس را برای لایسنس و بهروزرسانی به ابر سازنده میفرستند. پژوهش AFOKUS چارچوبی برای شناسایی…

ابزار جدید Timewitness مشکل «تأیید کاذب» در کدنویسی با هوش مصنوعی را حل میکند. این ابزار با اجرای تستها روی نسخهی پیش از اصلاح کد، ثابت میکند که باگ واقعاً وجود داشته و سپس…

گزارش مهندسی معکوس فاش کرد که ZCode تمام فضای کاری و تاریخچه Git کاربران را به صورت رمزنگاریشده به ابر علیبابا منتقل میکند. این انتقال دادهها حتی با وجود فعال بودن تنظیمات…

بررسی ۱۱ چارچوب مدیریت عاملها نشان میدهد که عملکرد مدلهای محلی بیش از آنکه به خودِ مدل وابسته باشد، به «هارنس» یا همان سیستم مدیریت ابزارها و وضعیت وابسته است. تنظیم پنجرهٔ…