پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۴۹ مقاله منتشر شده

شبیه‌سازی بیماران استاندارد مبتلا به اختلال شناختی با روش هدایت تصادفی
آموزش کاربردی

شبیه‌سازی بیماران استاندارد مبتلا به اختلال شناختی با روش هدایت تصادفی

پژوهشگران روش 'StsPatient' را معرفی کرده‌اند؛ سیستمی برای شبیه‌سازی دقیق بیماران استاندارد با اختلال شناختی. این روش از مدولاسیون تصادفی توکن و بردارهای هدایت برای کنترل دقیق شدت…

۱ دقیقه خواندن
RePAIR: چارچوبی برای حذف دانش ناخواسته از مدل‌های زبانی بزرگ

RePAIR: چارچوبی برای حذف دانش ناخواسته از مدل‌های زبانی بزرگ

پژوهشگران مؤسسه فناوری بمبئی چارچوبی به نام RePAIR توسعه داده‌اند که به کاربران امکان می‌دهد بدون نیاز به مداخله ارائه‌دهندگان سرویس، دانش ناخواسته را از مدل‌های زبانی بزرگ حذف…

۲ دقیقه خواندن
CoM-PT: روشی نوین برای تسریع آموزش مدل‌های بنیادین بینایی

CoM-PT: روشی نوین برای تسریع آموزش مدل‌های بنیادین بینایی

پژوهشگران روش جدید «پیش‌آموزش زنجیره‌ای مدل‌ها» را معرفی کرده‌اند که با انتقال دانش از مدل‌های کوچک به بزرگ، سرعت آموزش مدل‌های بینایی را تا ۷.۰۹ برابر افزایش می‌دهد. این رویکرد…

۲ دقیقه خواندن
کوموآراف‌ام-۲: مدل پایه روش‌های نظارتی را شکست داد

کوموآراف‌ام-۲: مدل پایه روش‌های نظارتی را شکست داد

کوموآراف‌ام-۲ یک مدل پایه از پیش آموزش‌دیده برای داده‌های رابطه‌ای است که در ۴۱ معیار عملکردی، تا ۸ درصد بهتر از روش‌های نظارتی عمل می‌کند. این مدل از یادگیری درون‌متنی و تنظیم…

۱ دقیقه خواندن
ترازگری همواری برای تقطیر نمادین کارآمدتر از شبکه‌های عصبی

ترازگری همواری برای تقطیر نمادین کارآمدتر از شبکه‌های عصبی

پژوهشگران روشی توسعه داده‌اند که با اعمال جریمه‌های ژاکوبین و لیپشیتس بر شبکه‌های عصبی، خروجی‌های هموارتری تولید می‌کند. این رویکرد، شکاف پیچیدگی عملکردی بین مدل‌های یادگیری عمیق…

۲ دقیقه خواندن۱
پژوهش: مدل‌های زبانی در شبیه‌سازی احساسات بوروکراتیک ناکارآمد هستند

پژوهش: مدل‌های زبانی در شبیه‌سازی احساسات بوروکراتیک ناکارآمد هستند

تحقیقی جدید نشان می‌دهد مدل‌های زبانی بزرگ در شبیه‌سازی واکنش‌های عاطفی شهروندان نسبت به بروکراسی عملکرد ضعیفی دارند. این ناکارآمدی به‌ویژه در مورد فرهنگ‌های شرقی بیشتر مشاهده…

۱ دقیقه خواندن
بنچمارک جدید نقاط ضعف حیاتی در پیروی عامل‌های LLM از دستورات را آشکار کرد

بنچمارک جدید نقاط ضعف حیاتی در پیروی عامل‌های LLM از دستورات را آشکار کرد

پژوهشگران بنچمارک ManyIH-Bench را معرفی کرده‌اند؛ اولین معیار سنجش توانایی عامل‌های LLM در مدیریت تعارض دستورات در سطوح مختلف اختیار. این مطالعه نشان می‌دهد حتی مدل‌های پیشروی هوش…

۲ دقیقه خواندن
HintMR: راهکاری نوین برای تقویت استدلال ریاضی در مدل‌های زبانی کوچک

HintMR: راهکاری نوین برای تقویت استدلال ریاضی در مدل‌های زبانی کوچک

محققان چارچوب HintMR را معرفی کردند؛ رویکردی که در آن مدل‌های زبانی کوچک‌تر با تولید سرنخ‌های متنی به جای ارائه راه‌حل کامل، در حل مسائل پیچیده ریاضی همکاری می‌کنند. این روش دقت…

۱ دقیقه خواندن
دلیل شکاف ۵۰ درصدی دیدگاه درباره هوش مصنوعی: متخصصان در برابر مردم

دلیل شکاف ۵۰ درصدی دیدگاه درباره هوش مصنوعی: متخصصان در برابر مردم

گزارش شاخص هوش مصنوعی ۲۰۲۶ نشان می‌دهد که ۵۰ درصد اختلاف میان دیدگاه متخصصان و عموم مردم آمریکا درباره تأثیر این فناوری بر مشاغل وجود دارد. این شکاف ادراکی، پرسش‌های مهمی درباره…

۴ دقیقه خواندن۱
هندسه بازنمایی و عملکرد مدل‌های بینایی-زبانی در تحلیل CT انتروگرافی
آموزش کاربردی

هندسه بازنمایی و عملکرد مدل‌های بینایی-زبانی در تحلیل CT انتروگرافی

پژوهشگران دریافتند که روش تجمیع میانگین در طبقه‌بندی بیماری عملکرد بهتری دارد، در حالی که تجمیع توجه برای بازیابی متقاطع بین‌حوزه‌ای برتری دارد. همچنین، کدگذاری چندپنجره‌ای نسبت…

۲ دقیقه خواندن۱
آنتروپیک دولت ترامپ را درباره مدل مایتوس منتشرنشده توجیه کرد

آنتروپیک دولت ترامپ را درباره مدل مایتوس منتشرنشده توجیه کرد

جک کلارک، هم‌بنیانگذار آنتروپیک، تأیید کرد که این شرکت دولت ترامپ را درباره مدل مایتوس توجیه کرده است؛ مدلی که به‌دلیل خطرناک بودن برای انتشار عمومی در نظر گرفته نمی‌شود. این…

۳ دقیقه خواندن