
MODF-SIR: دستیابی به SOTA در استدلال اجتماعی با تنها ۳۰٪ از دادهها
چارچوب MODF-SIR با ترکیب تقطیر دانش و تطبیق زمان تست، استدلالهای اجتماعی پیچیده را با بهرهگیری از تنها ۳۰٪ از مجموعهداده IntentTrain بهینهسازی کرده است. این مدل با تمرکز بر…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۷۷ مقاله منتشر شده

چارچوب MODF-SIR با ترکیب تقطیر دانش و تطبیق زمان تست، استدلالهای اجتماعی پیچیده را با بهرهگیری از تنها ۳۰٪ از مجموعهداده IntentTrain بهینهسازی کرده است. این مدل با تمرکز بر…

AutoMine با ترکیب مدلهای زبانی و بینایی، استخراج خودکار سناریوهای بحرانی رانندگی از دادههای حجیم را ممکن کرده است. این چارچوب با استفاده از حلقهی اصلاح کد، توانست در رقابت…

پژوهشگران چارچوبی مبتنی بر نظریه یادگیری آماری برای تعریف دقیق «قابلیت استنتاج» در قانون هوش مصنوعی اتحادیه اروپا ارائه کردهاند. این رویکرد با تحلیل کل جریان داده بهجای تمرکز…

چارچوب استنتاجی جدید RecToM با استفاده از بازسازی بازگشتی دیدگاهها، مدلهای زبانی را قادر ساخت تا باورهای تودرتو را بهطور دقیق مدلسازی کنند. این متد با بهرهگیری از GPT-5.4 و…

محققان مدل Lung-R1 را توسعه دادهاند؛ یک مدل زبانی بزرگ ۱۴ میلیارد پارامتری که با ادغام یک گراف دانش گسترده، از بازیابی سادهی حقایق به استدلال تشخیصی بیمار-محور حرکت میکند. این…

TreeSeeker چارچوب جدیدی است که با استفاده از حافظه ساختاردرختی و سیگنالهای UCB، مانع از گیر کردن عاملهای هوش مصنوعی در مسیرهای بنبست میشود. این رویکرد ثابت میکند که برای…

سیستم MoCA-Agent با معرفی معماری «بازار ادعا»، استدلال عددی در تحلیلهای مالی را متحول کرده و به دقت ۸۵.۶٪ در بنچمارک FinChart-Bench رسیده است. این مدل بهجای بحثهای متنی، بر…

وصلههای امنیتی بحرانی React و مدلهای کمهزینهی جدید OpenAI محور بهروزرسانیهای این هفته هستند. مهندسان باید سریعاً آسیبپذیری RSC را رفع کرده و پیش از ۱۴ جولای به GPT-4.1 Nano…

ترکیب ابزارهای Consensus و NotebookLM کارآمدترین روش برای پژوهشهای علمی است. این رویکرد با ترکیب شواهد گسترده و مبنیسازی شخصی، احتمال توهمات مدل را به حداقل میرساند.

مهندسی هوش مصنوعی از رپرهای سادهی API به سمت سیستمهای عاملمحور و تخصصی حرکت میکند. توسعهدهندگان برتر اکنون برای دستیابی به پایداری و کاهش هزینه، بر RAG عاملمحور و مدلهای…

پژوهش جدید شرکت Writer نشان میدهد سیستمهای حافظه برای شخصیسازی، میتوانند دقت مدلها را کاهش دهند. این ابزارها مدل را به سمت چاپلوسی سوق میدهند تا به جای حقیقت، باورهای غلط…

هوش مصنوعی اکنون میتواند وصلههای امنیتی را طی چند ساعت به ابزارهای حمله (Exploit) تبدیل کند. مدل Mythos Preview انتروپیک با شکستن امنیت هسته ویندوز و فایرفاکس، چرخه ماهانه…