پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۴ مقاله منتشر شده

نمره‌دهی به استدلال حقوقی مدل زبانی با قاضی هوش مصنوعی
آموزش کاربردی

چرا پاسخ درست در هوش مصنوعی حقوقی می‌تواند خطرناک‌ترین معیار باشد؟

مدل‌های زبانی اغلب با منطقی غلط به پاسخی درست می‌رسند. روش جدید LegalBench با استفاده از «سیگنال‌های اتمیک» و چارچوب IRAC، خطاهای استدلالی را از نتایج تصادفی جدا می‌کند تا توهمات…

۶ دقیقه خواندن۲
آیا حافظه ضعیف هوش مصنوعی را محتاط‌تر می‌کند؟ ما آزمایش کردیم
آموزش کاربردی

چگونه تزریق خاطرات جعلی از شکست، ریسک‌پذیری عامل‌های هوش مصنوعی را کاهش می‌دهد؟

پژوهش‌های جدید نشان می‌دهد تزریق تاریخچه‌ای جعلی از شکست‌ها در حافظه‌ی مدل‌ها، جسارت آن‌ها در تصمیم‌گیری را به‌شدت می‌کوبد. این پدیده بدون تخریب منطق مدل یا فعال کردن سیستم‌های…

۱۰ دقیقه خواندن۲
چرا سیستم‌های چند-عاملی هوش مصنوعی در مقیاس واقعی شکست می‌خورند؟
آموزش کاربردی

چرا سیستم‌های چند-عاملی هوش مصنوعی در مقیاس واقعی شکست می‌خورند؟

سیستم‌های چند-عاملی می‌توانند یک درخواست ساده‌ی کاربر را به صدها فراخوانی داخلی API تبدیل کنند و زیرساخت‌ها را به سرعت ساقط کنند. پیاده‌سازی محدودیت‌های نرخ درخواست داخلی، راهکاری…

۳ دقیقه خواندن۱
بازتعریف SFT به عنوان مسئله طراحی توزیع هدف برای بهبود استدلال مدل‌ها

بازتعریف SFT به عنوان مسئله طراحی توزیع هدف برای بهبود استدلال مدل‌ها

پژوهشگران چارچوب جدیدی به نام Target-SFT معرفی کرده‌اند که تنظیم دقیق نظارت‌شده (SFT) را به جای بهینه‌سازی توابع زیان، به عنوان یک مسئله طراحی توزیع هدف می‌بیند. این متد با عبور…

۱ دقیقه خواندن
معمای شفافیت: چگونه افشای جزئیات هوش مصنوعی به «الگوهای تاریک» تبدیل می‌شود؟

معمای شفافیت: چگونه افشای جزئیات هوش مصنوعی به «الگوهای تاریک» تبدیل می‌شود؟

پژوهشی جدید نشان می‌دهد شفافیت بیش از حد در گزارش‌های AI می‌تواند نتیجه معکوس داشته باشد و اعتماد مخاطب را کاهش دهد. کاربران به‌جای توضیحات مفصل، تعاملات «جزئیات در صورت تقاضا» و…

۱ دقیقه خواندن
حذف وابستگی استراتژی به اجرا؛ رویکرد Piper برای ساده‌سازی موازی‌سازی توزیع‌شده

حذف وابستگی استراتژی به اجرا؛ رویکرد Piper برای ساده‌سازی موازی‌سازی توزیع‌شده

سیستم Piper با جداسازی استراتژی‌های آموزش از پیاده‌سازی زمان اجرا، پیچیدگی‌های موازی‌سازی مدل‌های عظیم را کاهش می‌دهد. این سیستم از یک نمایش میانی (IR) مبتنی بر گراف برای اجرای…

۱ دقیقه خواندن
چگونه SECDA-DSE طراحی شتاب‌دهنده‌های FPGA را با مدل‌های زبانی خودکار می‌کند؟

چگونه SECDA-DSE طراحی شتاب‌دهنده‌های FPGA را با مدل‌های زبانی خودکار می‌کند؟

چارچوب SECDA-DSE با ادغام مدل‌های زبانی بزرگ، فرآیند پیچیده جست‌وجوی فضای طراحی (DSE) در شتاب‌دهنده‌های FPGA را خودکار می‌کند. این سیستم با ترکیب RAG و زنجیره تفکر، نیاز به تخصص…

۱ دقیقه خواندن
چگونه FADA تحلیل تخصصی سونوگرافی جنین را به سخت‌افزار موبایل منتقل کرد؟

چگونه FADA تحلیل تخصصی سونوگرافی جنین را به سخت‌افزار موبایل منتقل کرد؟

مدل FADA با یکپارچه‌سازی تشخیص و تحلیل سونوگرافی جنین در یک خط لوله واحد، امکان تشخیص بالینی آفلاین را روی گوشی‌های هوشمند فراهم کرده است. این سیستم با هدف کاهش شکاف تشخیصی در…

۲ دقیقه خواندن