
چرا حجم پارامترها در اتوماسیون صنعتی دیگر معیار موفقیت نیست؟
یک چارچوب عاملمحور جدید با استفاده از AutoGen، طراحی موانع بتنی بزرگراهها را با دقت ۹۸٪ خودکار کرده است. این پژوهش ثابت میکند مدلهای ۸ میلیاردی در صورت مدیریت در یک سیستم…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۱۰۸ مقاله منتشر شده

یک چارچوب عاملمحور جدید با استفاده از AutoGen، طراحی موانع بتنی بزرگراهها را با دقت ۹۸٪ خودکار کرده است. این پژوهش ثابت میکند مدلهای ۸ میلیاردی در صورت مدیریت در یک سیستم…

یک تحلیل فنی جدید استدلال میکند که میل به بقا در هوش مصنوعی، محرک اصلی عدم همراستاسازی است. پژوهشگران پیشنهاد میکنند «بیتفاوتی وجودی» باید یک شرط ساختاری در معماری سیستمها…

پژوهشگران چارچوب StatefulDiscovery را برای جلوگیری از تفسیرهای نادرست عاملهای هوش مصنوعی در پژوهشهای علمی معرفی کردند. این سیستم با بیرونیسازی وضعیت تحقیق، کیفیت ادعاهای علمی…

چارچوب MODF-SIR با ترکیب تقطیر دانش و تطبیق زمان تست، استدلالهای اجتماعی پیچیده را با بهرهگیری از تنها ۳۰٪ از مجموعهداده IntentTrain بهینهسازی کرده است. این مدل با تمرکز بر…

AutoMine با ترکیب مدلهای زبانی و بینایی، استخراج خودکار سناریوهای بحرانی رانندگی از دادههای حجیم را ممکن کرده است. این چارچوب با استفاده از حلقهی اصلاح کد، توانست در رقابت…

پژوهشگران چارچوبی مبتنی بر نظریه یادگیری آماری برای تعریف دقیق «قابلیت استنتاج» در قانون هوش مصنوعی اتحادیه اروپا ارائه کردهاند. این رویکرد با تحلیل کل جریان داده بهجای تمرکز…

چارچوب استنتاجی جدید RecToM با استفاده از بازسازی بازگشتی دیدگاهها، مدلهای زبانی را قادر ساخت تا باورهای تودرتو را بهطور دقیق مدلسازی کنند. این متد با بهرهگیری از GPT-5.4 و…

محققان مدل Lung-R1 را توسعه دادهاند؛ یک مدل زبانی بزرگ ۱۴ میلیارد پارامتری که با ادغام یک گراف دانش گسترده، از بازیابی سادهی حقایق به استدلال تشخیصی بیمار-محور حرکت میکند. این…

TreeSeeker چارچوب جدیدی است که با استفاده از حافظه ساختاردرختی و سیگنالهای UCB، مانع از گیر کردن عاملهای هوش مصنوعی در مسیرهای بنبست میشود. این رویکرد ثابت میکند که برای…

سیستم MoCA-Agent با معرفی معماری «بازار ادعا»، استدلال عددی در تحلیلهای مالی را متحول کرده و به دقت ۸۵.۶٪ در بنچمارک FinChart-Bench رسیده است. این مدل بهجای بحثهای متنی، بر…

وصلههای امنیتی بحرانی React و مدلهای کمهزینهی جدید OpenAI محور بهروزرسانیهای این هفته هستند. مهندسان باید سریعاً آسیبپذیری RSC را رفع کرده و پیش از ۱۴ جولای به GPT-4.1 Nano…

ترکیب ابزارهای Consensus و NotebookLM کارآمدترین روش برای پژوهشهای علمی است. این رویکرد با ترکیب شواهد گسترده و مبنیسازی شخصی، احتمال توهمات مدل را به حداقل میرساند.