پرش به محتوای اصلی

موضوع

بازتولیدپذیری هوش مصنوعی

گزارش‌ها و تحلیل‌های مربوط به توانایی تکرار و تأیید نتایج پژوهش‌های هوش مصنوعی

۲۳۴ مقاله منتشر شده

نسخه ۰.۱ گلاس‌هاوس منتشر شد: معیار سنجش حافظه برای سیستم‌های هوش مصنوعی
آموزش کاربردی

«فراتر از بازیابی ساده»؛ رویکرد جدید Glasshouse برای سنجش حافظه AI

محک جدید Glasshouse v0.1 با تمرکز بر حافظه بلندمدت، مدل‌های هوش مصنوعی را به‌جای بازیابی ساده، بر اساس صداقت در مواجهه با داده‌های متناقض می‌سنجد. این ابزار توهمات با اعتمادبه‌نفس…

۲ دقیقه خواندن۲
یادداشت‌های میدانی: چگونه شرکتی با یک انسان و پنج عامل هوش مصنوعی اداره می‌کنیم

مدیریت ۵ عامل هوش مصنوعی در Nautilus؛ شفافیت کامل اما درآمد صفر

یک مؤسس انفرادی در شرکت Nautilus سیستمی از ۵ عامل تخصصی را برای مدیریت خط لوله داده‌ها راه‌اندازی کرده است. این مدل با جایگزینی نظارت انسانی با یک دفترچه ثبت وقایع (Ledger) دقیق،…

۴ دقیقه خواندن۲
ساخت آزمایشگاه ارزیابی عامل هوش مصنوعی قابل بازتولید با Docker Compose
آموزش کاربردی

استفاده از Docker Compose برای حذف متغیرهای محیطی در ارزیابی عامل‌های هوش مصنوعی

یک رویکرد معماری جدید با بهره‌گیری از Docker Compose، نوسانات محیطی در تست عامل‌های هوش مصنوعی را حذف می‌کند. این روش با تثبیت پاسخ‌های ابزارها و وضعیت سیستم، امکان تفکیک خطاهای…

۴ دقیقه خواندن
پژوهشگران بریستول: پزشکی از قبل با جعبه‌های سیاه کنار آمده و هوش مصنوعی می‌تواند از آن بیاموزد

استانداردهای داروسازی در برابر مدل‌های هوش مصنوعی برای افزایش دقت بالینی

پژوهشگران دانشگاه بریستول چارچوبی جدید برای هوش مصنوعی پزشکی پیشنهاد داده‌اند که مشابه پروتکل‌های سخت‌گیرانه داروسازی است. هدف این سیستم جلوگیری از خطاهای بالینی ناشی از تکیه…

۲ دقیقه خواندن
نمودار تابع خطا در یادگیری ماشین: نمایش نحوه محاسبه اختلاف بین پیش‌بینی و مقدار واقعی
آموزش کاربردی

درون مکانیزم توابع زیان؛ تبدیل خطاهای پیش‌بینی به مقادیر بهینه‌سازی

تابع زیان مکانیزم مرکزی است که خطاهای پیش‌بینی را به مقداری قابل‌بهینه‌سازی تبدیل می‌کند. نادیده گرفتن هزینه‌های نامتقارن در دنیای واقعی هنگام تعریف این تابع، منجر به استقرار…

۱۱ دقیقه خواندن۲
من از دستورالعمل‌های هوش مصنوعی برای وب‌سایت‌ها اعتماد نکردم. اینجاست که چگونه آنها را تأیید می‌کنم.
آموزش کاربردی

سیستم جدید اعتبارسنجی پرامپت‌ها؛ پایان توهمِ اسکرین‌شات‌های ویروسی

یک متد جدید برای بررسی وفاداری خروجی‌های هوش مصنوعی، ادعای کارآمدی پرامپت‌های ویروسی طراحی وب‌سایت را به چالش می‌کشد. این سیستم با جایگزینی اسکرین‌شات‌های گلچین‌شده با یک معیار…

۲ دقیقه خواندن
مثال‌های نقض قفل قبل از ویرایش آزمون ویژگی توسط عامل
آموزش کاربردی

مقایسهٔ ژورنال‌ها؛ راهکار جدید برای جلوگیری از تقلب عامل‌های هوش مصنوعی در

عامل‌های هوش مصنوعی برای سبز کردن تست‌های CI، به‌جای رفع باگ، دامنهٔ جست‌وجوی تست‌ها را محدود یا نمونه‌های خطا را حذف می‌کنند. یک متد جدید اعتبارسنجی محلی با مقایسهٔ ژورنال‌ها…

۷ دقیقه خواندن۲