گزیدهای از خواندنیترین و مهمترین مطالب داتهوش.

پژوهشگران SpecBranch را معرفی کردهاند؛ چارچوبی نوآورانه که با ایجاد شاخههای موازی در رمزگشایی حدسی، زمان انتظار میان مدل پیشنویس و مدل هدف را کاهش میدهد. این روش سرعت استنتاج را بین ۱.۸ تا ۴.۵ برابر افزایش داده و تعداد توکنهای بازگشتی را برای مدلهای با هماهنگی ضعیف، نصف میکند.

پژوهشگران با بررسی ۱۲ معیار سنجش، عملکرد مدلهای زبانی بزرگ در وظایف تأیید صحت را تحلیل کردند. این مطالعه نشان داد که سختی مسئله، توانمندی تولیدکننده و قابلیت تأییدکننده بهصورت پیچیدهای با یکدیگر تعامل دارند. نکته قابل توجه اینکه استفاده از تأییدکننده مبتنی بر Gemma2-9B شکاف عملکردی با مدل Gemma2-27B را به میزان ۷۵.۷ درصد کاهش داد.

محققان فریمورک AdaMCoT (زنجیره فکری تطبیقی چندزبانه) را معرفی کردهاند که با هدایت پویای فرآیندهای تفکر از طریق «زبانهای میانی» و سپس تولید پاسخ به زبان هدف، استدلال مبتنی بر واقعیت را در مدلهای زبانی بزرگ بهبود میدهد. این رویکرد بدون نیاز به پیشآموزش اضافی، کیفیت استدلال و سازگاری بینزبانی را بهطور قابل توجهی ارتقا میدهد، بهویژه در زبانهای کممنبع.

پژوهشگران مدلی یکپارچه معرفی کردهاند که از متن، تصویر یا ترکیب هر دو برای تولید کد استفاده میکند و قابلیتهای پیشرفته بصری-برنامهنویسی را فراهم میسازد. این رویکرد برخلاف کارهای پیشین که مدلهای تخصصی مجزا میساختند، همه تواناییها را در یک معماری واحد گردآوری کرده است.

پژوهشگران چارچوبی به نام Lightning OPD معرفی کردهاند که فرآیند آموزش مدلهای زبانی بزرگ را بدون نیاز به سرور آنلاین معلم امکانپذیر میسازد. این روش با پیشمحاسبه احتمالات لاگ از مدل معلم و حفظ ثبات در انتخاب مدل، به دقت ۶۹.۹٪ در آزمون ریاضی AIME 2024 دست یافته و در مدت تنها ۳۰ ساعت GPU به این نتایج رسیده است.

تیمی از پژوهشگران روش «همترازی معنایی زبانآگنوستیک» (LASA) را توسعه دادهاند که مکانیزمهای ایمنی هوش مصنوعی را به جای متن سطحی، در فضای معنایی مستقل از زبان verankert میکند. این روش نرخ موفقیت حملات را از ۲۴.۷ درصد به ۲.۸ درصد کاهش داده و در زبانهای کممنابع نیز عملکرد قابل قبولی نشان میدهد.

پژوهشگران از محاسبات تکاملی مبتنی بر مدلهای زبانی بزرگ برای بهینهسازی پرسوجوهای حدس رمز عبور استفاده کردند. این روش نرخ شکستن رمز را از ۲.۰۲ درصد به ۸.۴۸ درصد افزایش داد. نتایج نشان میدهد که بهینهسازی پرسوجو میتواند ابزارهای حسابرسی رمز عبور را به طور چشمگیری بهبود بخشد.

پژوهشگان نشان دادند مدلهای زبانی بزرگ عمومی میتوانند دادههای پرونده الکترونیک سلامت را با کیفیتی مشابه مدلهای تخصصی حوزه پزشکی رمزگذاری کنند. این رویکرد با تبدیل کدهای پزشکی به توصیفهای زبان طبیعی، بدون نیاز به دسترسی به دادههای خصوصی آموزشی به تعبیههای چندبعدی دست مییابد. در اعتبارسنجی با مجموعه داده UK Biobank، این مدلها در برخی وظایف بهبود معناداری نشان دادند.

یک مرور نظاممند از ۵۲ مطالعه درباره عوامل آموزشی مبتنی بر مدلهای زبانی بزرگ رونمایی شده که چهار بُعد کلیدی طراحی و روندهای نوظهور مانند سیستمهای چندعاملی و ادغام با فناوریهای فراگیر را شناسایی کرده است. این پژوهش فرصتهای قابل توجهی را در کنار نگرانیهای اخلاقی درباره حریم خصوصی، دقت محتوا و استقلال دانشآموزان مورد توجه قرار میدهد.

پژوهشگران چارچوبی نوین برای انتقال دانش از مدلهای زبانی بزرگ به سیستمهای نمادین توسعه دادهاند. این رویکرد ترکیبی با بهرهگیری از ماشینهای تسِتلین، شفافیت کامل را با درک معنایی ادغام میکند و امکان تفسیرپذیری الگوهای یادگیریشده را فراهم میسازد.

پژوهشگران معیار EgoEsportsQA را معرفی کردهاند که برای سنجش عملکرد مدلهای ویدئویی-زبانی در محیطهای سریع و مبتنی بر قوانین ورزشهای الکترونیکی طراحی شده است. این مجموعه داده شامل ۱٬۷۴۵ جفت پرسش و پاسخ از مسابقات حرفهای سه بازی تیراندازی اولشخص است و نشان میدهد که حتی بهترین مدلهای فعلی تنها به دقت ۷۱٫۵۸٪ دست مییابند. این یافتهها شکافهای اساسی در توانایی هوش مصنوعی برای استدلال تاکتیکی عمیق در محیطهای مجازی را آشکار میسازد.

دیپال، شرکت آلمانی پیشرو در ترجمه متنی، با راهاندازی مجموعه جدید ترجمه صوتی وارد بازار ترجمه همزمان شد. این ابزار جدید از جلسات، مکالمات تلفنی و گروهی پشتیبانی میکند و API آن برای توسعهدهندگان نیز در دسترس قرار گرفته است. مدیرعامل شرکت این گسترش را گامی طبیعی در مسیر تکامل دانست.

تیم پژوهشی M$^*$ روشی نوین ارائه کرده که با استفاده از تکامل برنامهای، بهطور خودکار سامانههای حافظه تخصصی را برای وظایف مختلف عاملهای هوش مصنوعی کشف میکند. این رویکرد در مقایسه با روشهای سنتی حافظه ثابت، عملکرد قابلتوجهی بهتری نشان داده است.

پژوهشی تازه نشان داده که روشهای افزایش داده مبتنی بر LLM و بازنویسی معکوس در زبانهای کممنبع آفریقایی، عملکرد هر نوع وظیفه را به شکل متفاوتی تحت تأثیر قرار میدهند. برخلاف تصور رایج، کیفیت بالاتر تولید متن توسط LLM لزوماً به نتایج بهتر در افزایش داده منجر نمیشود.

پژوهشگران چارچوبی به نام EmergentBridge معرفی کردهاند که انتقال یادگیری صفر-نمونهای میان حالتهای جفتنشده را در مدلهای تعبیهی چندحالتی یکپارچه بهبود میبخشد. این روش نیازی به جمعآوری گسترده داده برای تمام جفتهای حالتی ندارد.

پژوهشگران روشی مبتنی بر یادگیری تقویتی ابداع کردهاند که برنامههای حرکتی تولیدشده توسط برنامهریزهای ترکیبی را بهگونهای اصلاح میکند که با محدودیتهای فیزیکی رباتهای واقعی سازگار شوند. این روش با گنجاندن قیود دینامیک مرتبه دوم در فرایند تصمیمگیری، شکاف میان برنامهریزی نظری و اجرای عملی را پر میکند.

پژوهشگران دریافتند که افزایش تعداد چهرهها در هر تصویر بهطور مداوم عملکرد مدلهای یادگیری ماشین را کاهش میدهد؛ بهطوری که نرخ خطا در صحنههای شلوغ تا ۴.۶ برابر بیشتر است. این یافته نشان میدهد که تراکم نمونهها میتواند بهعنوان یک عامل ذاتی در تعیین دشواری دادهها عمل کند.

پژوهشگران چارچوب یادگیری عمیق جدیدی به نام GTCN-G معرفی کردهاند که با ادغام شبکههای عصبی زمانی و مبتنی بر گراف، سیستمهای شناسایی نفوذ را ارتقا میدهد. این مدل بهطور ویژه مشکل عدم تعادل کلاسها در دادههای ترافیک شبکه را هدف قرار داده که اغلب باعث نادیده گرفته شدن تهدیدات نادر اما حیاتی میشود. نتایج آزمایش روی مجموعه دادههای استاندارد نشاندهنده برتری این روش در شناسایی حملات سایبری رایج و غیرمعمول است.

یک مقاله تحقیقاتی جدید چارچوبی ساختاریافته برای توسعه دیتاستهای ایمن متناسب با استانداردهای ISO/PAS 8800 در حوزه رانندگی خودکار معرفی کرده است. این چارچوب کل چرخه عمر دادهها—از جمعآوری تا نگهداری—را پوشش میدهد و شامل تحلیلهای ایمنی دقیقی برای شناسایی و کاهش خطرات ناشی از کمبودهای دیتاست میشود.

رید هافمن، یکی از بنیانگذاران لینکدین، از شیوه ردیابی میزان مصرف توکن هوش مصنوعی توسط کارکنان حمایت کرده است. او این معیار را ابزاری مفید برای ارزیابی میداند، هرچند منتقدان معتقدند این روش به جای بهرهوری واقعی، فقط هزینهها را اندازهگیری میکند.

پژوهشگران روش 'StsPatient' را معرفی کردهاند؛ سیستمی برای شبیهسازی دقیق بیماران استاندارد با اختلال شناختی. این روش از مدولاسیون تصادفی توکن و بردارهای هدایت برای کنترل دقیق شدت اختلال استفاده میکند و میتواند آموزش بالینی را متحول کند.

پژوهشگران روشی نوین مبتنی بر گراف معرفی کردهاند که با حفظ زنجیره استدلال برای هر مدرک، سیستمهای بازیابی-افزوده را قادر به بهبود خودکار میکند. این رویکرد بدون نیاز به بازآموزش مدل، خطا را تا ۴۷ درصد کاهش میدهد و در سناریوهای تکراری به صرفهجویی قابل توجهی در هزینه و زمان پاسخ منجر میشود.

پژوهشگران SIR-Bench را توسعه دادهاند؛ معیاری جامع متشکل از ۷۹۴ مورد آزمون برای سنجش توانایی عوامل خودکار پاسخگو به رخدادهای امنیتی در انجام تحقیقات واقعی فارنزیک. این معیار از ۱۲۹ الگوی رخداد ناشناسسازیشده استخراج شده و با رویکردی رقابتی از نوع LLM-as-Judge عمل میکند.

پژوهشگران مؤسسه فناوری بمبئی چارچوبی به نام RePAIR توسعه دادهاند که به کاربران امکان میدهد بدون نیاز به مداخله ارائهدهندگان سرویس، دانش ناخواسته را از مدلهای زبانی بزرگ حذف کنند. این سیستم از دستورات زبان طبیعی برای ویرایش مدل در زمان استنتاج استفاده میکند.

تیمی از پژوهشگران پلتفرم «پیایال» را توسعه دادهاند که ویدیوهای سخنرانی را به تجربههای یادگیری تعاملی تبدیل میکند. این سیستم با تحلیل لحظهای محتوا، سؤالات را بر اساس پاسخهای هر یادگیرنده تنظیم کرده و خلاصهای شخصیسازیشده ارائه میدهد.

پژوهشگران روش جدید «پیشآموزش زنجیرهای مدلها» را معرفی کردهاند که با انتقال دانش از مدلهای کوچک به بزرگ، سرعت آموزش مدلهای بینایی را تا ۷.۰۹ برابر افزایش میدهد. این رویکرد بدون افت کیفیت، پیچیدگی محاسباتی را تا ۷۲ درصد کاهش میدهد.

کوموآرافام-۲ یک مدل پایه از پیش آموزشدیده برای دادههای رابطهای است که در ۴۱ معیار عملکردی، تا ۸ درصد بهتر از روشهای نظارتی عمل میکند. این مدل از یادگیری درونمتنی و تنظیم دقیق پشتیبانی میکند، جدولهای متصل را بهصورت بومی پردازش میکند و توانایی مقیاسپذیری به دادههای میلیاردی را دارد.

ادوبی دستیار هوش مصنوعی Firefly را که قبلاً Project Moonlight نام داشت، به صورت بتای عمومی عرضه کرد. این ابزار به کاربران امکان میدهد با زبان طبیعی در اپلیکیشنهایی مانند فتوشاپ و پریمیر وظایفی را انجام دهند. هدف ادوبی از این کار رقابت مستقیم با Canva و Figma است.

پژوهشگران روشی توسعه دادهاند که با اعمال جریمههای ژاکوبین و لیپشیتس بر شبکههای عصبی، خروجیهای هموارتری تولید میکند. این رویکرد، شکاف پیچیدگی عملکردی بین مدلهای یادگیری عمیق و رگرسیون نمادین را از بین میبرد و استخراج فرمولهای قابل فهم برای انسان را ممکن میسازد.

محققان «الگوریتم خنده» را معرفی کردند؛ چارچوبی چندعامله که کامنتهای طنز مناسب را برای ویدیوهای کوتاه تولید میکند و با نرخ ترجیح انسانی ۸۰ تا ۸۴ درصد از روشهای پایه پیشی گرفته است.