
«جداسازی استدلال از ایدئولوژی»؛ دستاورد جدید در تقطیر مدلهای زبانی
پژوهشی جدید نشان میدهد مدلهای زبانی میتوانند تواناییهای استدلالی پیشرفته را از مدلهای سانسورشده (مانند مدلهای چینی) بیاموزند، بدون اینکه محدودیتهای ایدئولوژیک یا الگوهای…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۸ مقاله منتشر شده

پژوهشی جدید نشان میدهد مدلهای زبانی میتوانند تواناییهای استدلالی پیشرفته را از مدلهای سانسورشده (مانند مدلهای چینی) بیاموزند، بدون اینکه محدودیتهای ایدئولوژیک یا الگوهای…

اندرو هو، پژوهشگر سابق OpenAI، معتقد است مقیاسپذیری مدلها دیگر کافی نیست و صنعت باید ۱۰۰ میلیارد دلار روی دادههای باکیفیت و زمینهای سرمایهگذاری کند. او هشدار میدهد که…

یک مهندس نرمافزار با طراحی خطلولهٔ عاملمحور و پیادهسازی سیستمهای تأیید قطعی، سرعت تولید ابزار در GenePattern را ۵ برابر کرد. این دستاورد ثابت میکند که ساختار مهندسی پیرامون…

شرکت OpenAI قیمت مدلهای GPT-5.6 Luna و Terra را بهشدت کاهش داد تا استقرار عاملهای هوش مصنوعی در مقیاس صنعتی بهصرفه شود. این تغییرات، بهویژه در مدل Luna، هزینههای عملیاتی…

برخلاف باور رایج، برای بازبینی کد با هوش مصنوعی نیازی به سختافزارهای گرانقیمت نیست و ۸ گیگابایت حافظه ویدیویی توازن ایدهآلی میان هزینه و عملکرد ایجاد میکند. جهش از مدلهای ۱.۵…

سامانه جدید گوگل دیپمایند به رباتهای انساننما اجازه میدهد تا دستورات پیچیده را با هماهنگی کامل تمام بدن اجرا کنند. این بهروزرسانی علاوه بر افزایش مهارت در کارهای ظریف، امکان…

پلتفرم AGI Ranker با بهروزرسانی سیستم امتیازدهی خود، ادعاهای متورم «سقف انسانی» را حذف کرد و باعث افت نمرات تقریباً تمام مدلهای پیشرو شد. این تغییر رویکرد، تمرکز پلتفرم را از…

پژوهشهای جدید نشان میدهد مدلهای زبانی بهدلیل فقدان «استنتاج ابداعی»، قادر به خلق چارچوبهای نظری جدید نیستند. تنها مدلهای جهانی (World Models) که بر پایه تجربه فیزیکی بنا…

رویکرد «برنامهنویسی بر اساس حس» (Vibe Coding) توسعهدهندگان را به دو گروه تقسیم کرده است: کسانی که خروجی هوش مصنوعی را کورکورانه میپذیرند و کسانی که از آن برای صیقل دادن منطق…

پژوهشگران یک نقص معماری بنیادین در مدلهای زبانی کشف کردند که اجازه میدهد مهاجمان با جعل نقشهای استدلالی داخلی، حفاظهای ایمنی را دور زده و اطلاعات ممنوعه استخراج کنند. این…

تنسنت چارچوب متنباز AngelSpec را برای بهینهسازی رمزگشایی گمانهزنانه در بارههای گفتگو و فنی معرفی کرد. این ابزار با استفاده از دو مدل پیشبین مجزا، توازن بین تولید متنهای…

شرکت Moonshot AI وزنهای مدل Kimi K3 را با معماری ترکیب خبرهها به صورت باز منتشر کرد. این مدل تحت یک لایسنس جدید عرضه شده که تا رسیدن درآمد سالانه شرکت کاربر به ۲۰ میلیون دلار،…