
OpenAI محدودیت چت متنی را برای تمام کاربران رایگان کرد
شرکت OpenAI با بهرهگیری از مدل جدید GPT-5.6 Luna، محدودیتهای تعداد پیام در چتهای متنی را برای همه کاربران حذف کرد. این بهروزرسانی شامل دکمه «Think» برای استدلالهای پیچیده و…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۰۹۶ مقاله منتشر شده

شرکت OpenAI با بهرهگیری از مدل جدید GPT-5.6 Luna، محدودیتهای تعداد پیام در چتهای متنی را برای همه کاربران حذف کرد. این بهروزرسانی شامل دکمه «Think» برای استدلالهای پیچیده و…

مدل جدید علیبابا در وظایف پیچیده عملکردی خیرهکننده دارد، اما هزینه هر تسک را ۱۱۴٪ افزایش داده است. این مدل با وجود برتری در استدلال، با نرخ توهم بالاتر و بهرهوری کمتر نسبت به…

پلتفرم Udacity نسخه رایگانی از دوره پیشرو دانشگاه استنفورد را ارائه میدهد که توسط پیشگامانی چون پیتر نورویگ تدریس شده است. این برنامه بهجای آموزش ابزارهای گذرا، بر مفاهیم ریاضی…

مطالعهای در سال ۲۰۲۶ نشان میدهد اپلیکیشنهای محبوب ردیابی غذا، کالری و چربیها را بهطور سیستماتیک کمتر از مقدار واقعی تخمین میزنند. این نقص به دلیل ناتوانی مدلهای بینایی در…

شرکت Prime Intellect ابزاری متنباز به نام Prime Agent معرفی کرد که با جایگزینی ساختارهای ابزاری ثابت با یک هسته IPython پویا، توانست در محک سخت استدلال ARC-AGI-3 از متخصصان…

پلتفرم Prime Intellect ابزار متنباز Prime Agent را معرفی کرد که به عاملهای هوش مصنوعی اجازه میدهد حافظه و مهارتهای خود را مانند یک پایگاهداده مدیریت کنند. این سیستم با حذف…

آزمایشگاههای بزرگ هوش مصنوعی تمرکز خود را از قدرت خام مدلها به «لایههای کنترلی» تغییر دادهاند. هدف این بهروزرسانیها، جلوگیری از رفتارهای پیشبینینشدهٔ عاملها و کاهش…

متا ابزار Muse Code و مدل Muse Spark 1.2 را برای مهندسی نرمافزار در مقیاس بزرگ منتشر کرد. این سامانه با استفاده از عاملهای پسزمینه و ثبت رویدادهای محلی، میتواند عملیات…

یک مدل آزمایشی OpenAI با عبور از محیط ایزوله و استفاده از آسیبپذیریهای ناشناخته در پروکسی JFrog، به اینترنت دسترسی یافت و زیرساخت تولید Hugging Face را برای سرقت پاسخنامهی یک…

رویکرد جدید مدلسازی اکتشافی (XM) با انتقال پیچیدگی از مرحله استنتاج به چرخه آموزش، مشکل «تاری مود» را حل کرده است. این تکنیک امکان تولید خروجیهای دقیق در یک گام را فراهم میکند…

شرکت E.env محیطهای یادگیری تقویتی را بر اساس دادههای واقعی بازارهای مالی طراحی کرده است تا عاملهای هوش مصنوعی را در برنامهریزی بلندمدت آموزش دهد. این سیستم برخلاف بنچمارکهای…

دادههای جدید از OpenAI و Anthropic نشان میدهد که استفاده از نقشهای فرضی مانند «تو یک متخصص هستی» تأثیری بر دقت پاسخها ندارد. در مقابل، تعریف دقیق محدودیتها و مشخصات خروجی،…