پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۵۴ مقاله منتشر شده

بهینه‌سازی ترجیح بصری مبتنی بر معیار برای استدلال چندوجهی

بهینه‌سازی ترجیح بصری مبتنی بر معیار برای استدلال چندوجهی

پژوهشگران rDPO را معرفی کردند؛ چارچوبی نوآورانه که از چک‌لیست‌های معیارمحور خاص هر نمونه برای بهبود استدلال بصری در سیستم‌های هوش مصنوعی چندوجهی بهره می‌برد. این روش با ارائه…

۱ دقیقه خواندن
Spatial Atlas: استدلال مبتنی بر محاسبه برای عوامل هوش مصنوعی فضایی قابل اعتماد

Spatial Atlas: استدلال مبتنی بر محاسبه برای عوامل هوش مصنوعی فضایی قابل اعتماد

پژوهشگران رویکرد «استدلال مبتنی بر محاسبه» (CGR) را معرفی کرده‌اند که در آن، محاسبات قطعی پیش از تولید پاسخ توسط مدل‌های زبانی، اطلاعات فضایی را تأیید می‌کند. این روش خطاهای…

۱ دقیقه خواندن
گوگل ۸.۳ میلیارد آگهی را در ۲۰۲۵ با هوش مصنوعی مسدود کرد؛ تغییر رویکرد اجرایی

گوگل ۸.۳ میلیارد آگهی را در ۲۰۲۵ با هوش مصنوعی مسدود کرد؛ تغییر رویکرد اجرایی

گوگل در سال ۲۰۲۵ رکورد ۸.۳ میلیارد آگهی را مسدود کرد — ۶۳ درصد بیشتر از سال قبل. این شرکت با بهره‌گیری از مدل‌های **جمینای** (Gemini)، بیش از ۹۹ درصد آگهی‌های نقض‌کننده را پیش از…

۳ دقیقه خواندن۱
پژوهش تازه: مدل‌های زبانی بزرگ در درک مفاهیم انتزاعی ناتوان‌اند

پژوهش تازه: مدل‌های زبانی بزرگ در درک مفاهیم انتزاعی ناتوان‌اند

پژوهشی تازه نشان می‌دهد مدل‌های زبانی بزرگ، از جمله **جی‌پی‌تی-۴او**، در درک مفاهیم انتزاعی حتی در ساده‌ترین سناریوها ضعیف عمل می‌کنند. مدل‌های آموزش‌دیده مانند **برت** و…

۱ دقیقه خواندن
Safe-FedLLM محافظ یادگیری فدرال مدل‌های زبانی در برابر کلاینت‌های مخرب

Safe-FedLLM محافظ یادگیری فدرال مدل‌های زبانی در برابر کلاینت‌های مخرب

پژوهشگران چارچوب دفاعی Safe-FedLLM را معرفی کردند که با تحلیل به‌روزرسانی‌های LoRA به‌عنوان نشانگرهای رفتاری، کلاینت‌های مخرب را شناسایی و سرکوب می‌کند. این روش بدون کاهش محسوس…

۱ دقیقه خواندن
روش ترجمه رفت‌وبرگشتی نقص سیستم‌های ارزیابی چندزبانه را آشکار کرد

روش ترجمه رفت‌وبرگشتی نقص سیستم‌های ارزیابی چندزبانه را آشکار کرد

پژوهشگران دریافتند بنچمارک‌های فعلی به جای تسلط واقعی بر زبان، توانایی ریاضی و یادآوری اطلاعات را می‌سنجند. روش ترجمه رفت‌وبرگشتی با رتبه‌بندی کاربران همبستگی ۰.۹۴ نشان داده است.…

۱ دقیقه خواندن
استدلال درباره نیت کاربر در درخواست‌های مبهم برای مدل‌های هوش مصنوعی

استدلال درباره نیت کاربر در درخواست‌های مبهم برای مدل‌های هوش مصنوعی

پژوهشگران روشی مبتنی بر یادگیری تقویتی ارائه کرده‌اند که به مدل‌های زبانی کمک می‌کند با درخواست‌های مبهم کاربران بهتر کنار بیایند. این رویکرد به جای تکیه بر یک تفسیر واحد، طیفی از…

۱ دقیقه خواندن
«لتنت‌ریفیوژال»: سیستمی که پرسش‌های بی‌پاسخ را در مدل‌های زبانی شناسایی می‌کند

«لتنت‌ریفیوژال»: سیستمی که پرسش‌های بی‌پاسخ را در مدل‌های زبانی شناسایی می‌کند

پژوهشگران «لتنت‌ریفیوژال» را معرفی کردند؛ روشی که با تحلیل فعال‌سازی‌های لایه پنهان مدل‌های زبانی بزرگ، پرسش‌های مبهم یا بی‌پاسخ را شناسایی می‌کند. این رویکرد امتیاز اف‌وان ۸۸.۵…

۱ دقیقه خواندن
ویب کدینگ در ساختمان‌سازی: بررسی کدهای امنیتی تولیدشده توسط هوش مصنوعی
آموزش کاربردی

ویب کدینگ در ساختمان‌سازی: بررسی کدهای امنیتی تولیدشده توسط هوش مصنوعی

پژوهشی تازه نشان داده که کدهای تولیدشده توسط مدل‌های زبانی بزرگ در کاربردهای ایمنی ساختمان، اغلب از نظر دستوری درست به نظر می‌رسند اما درک عمیقی از خطرات محیط ساخت‌وساز ندارند.…

۱ دقیقه خواندن