
رمزگشایی از TIDE: وقتی مدلهای کوچک از غولها تقلید میکنند
پژوهشگران چارچوب TIDE را معرفی کردند که اجازه میدهد مدلهای کوچک از مدلهای غولپیکر یاد بگیرند. این فناوری شکاف معماری را از بین برده و قدرت کدنویسی مدلهای کوچک را به شدت…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۰۸ مقاله منتشر شده

پژوهشگران چارچوب TIDE را معرفی کردند که اجازه میدهد مدلهای کوچک از مدلهای غولپیکر یاد بگیرند. این فناوری شکاف معماری را از بین برده و قدرت کدنویسی مدلهای کوچک را به شدت…

یک مطالعه جدید هشدار میدهد که هوش مصنوعی زاینده با تغییر معیارهای ارزیابی، در حال حذف تدریجی مهارتهای تخصصی استخدامکنندگان است. در این روند، بهرهوری اندک در برابر زوال…

پژوهشگران دریافتند که مدلهای UDDM مانند حافظههای تداعی عمل میکنند. اکنون میتوان با پایش آنتروپی شرطی، لحظهی دقیق گذار مدل از حفظ کردن دادهها به تعمیم اطلاعات را بهصورت کمی…

روشی جدید به نام Random Cloud اجازه میدهد بدون نیاز به آموزش اولیه، کوچکترین و بهینترین ساختار شبکههای عصبی شناسایی شوند. این متد با جایگزینی چرخه پرهزینه…

پژوهشگران ابزار متنباز HalluCiteChecker را برای شناسایی ارجاعات جعلی در مقالات علمی معرفی کردند. این ابزار سبک، بدون نیاز به GPU و بهصورت آفلاین روی CPUهای معمولی اجرا میشود تا…

یک چارچوب سلسلهمراتبی جدید با ترکیب قوانین قطعی و یادگیری تقویتشده، ایمنی پهپادها را در عملیات امداد و نجات متحول کرده است. این سیستم حتی بدون پیشآموزش، نرخ برخوردها را کاهش…

ViCrop-Det یک چارچوب استنتاج بدون نیاز به آموزش است که با استفاده از آنتروپی توجه، دقت تشخیص اشیاء کوچک را بهطور چشمگیری افزایش میدهد. این متد بدون تغییر در وزنهای مدل، mAP را…

یک مدل تخصصی Qwen2.5-7B در تریاژ پزشکی از GPT-4o پیشی گرفت. این نتیجه ثابت میکند تنظیم دقیق روی دادههای بالینی بسیار موثرتر از تکیه بر مدلهای عمومی عظیم است.

پژوهشگران یک عامل خودکار به نام XDFT طراحی کردهاند که دلیل شکست محاسبات نظریه تابعی چگالی در تطبیق با دادههای تجربی را تشخیص میدهد. این سیستم با نرخ موفقیت ۷۸ درصد، بهطور…

پژوهشگران اثر «مهارت غالب» را کشف کردند؛ پدیدهای که در آن یک مهارت تکنفره میتواند نرخ موفقیت کل یک تسک رباتیک را به شدت تغییر دهد. راهکار جدید برای بهروزرسانی مهارتها بدون…

یک چارچوب پژوهشی جدید پیشنهاد میکند که اعتماد در AI پزشکی نباید نتیجهی جانبی دقت مدل باشد، بلکه باید به عنوان یک ویژگی مهندسیشده و قابل اندازهگیری طراحی شود. این معماری…

پژوهشگران با طراحی یک خط لوله تطبیقی، ثابت کردند که استفاده از انگلیسی ساده در زمان بحرانها، سرعت و دقت ترجمه را بهشدت افزایش میدهد. این سیستم با تمرکز بر مدلهای زبانی کوچک،…