
آزمایشگاه حسینیالمدرسی: مدلسازی غیرخطی تاریخ بر پایه معماری ماشین حالت
سید علیرضا حسینی المدرسیه یک آزمایشگاه متنباز را معرفی کرد که با استفاده از معماری ماشین حالت، اثر مداخلات کوچک تاریخی را در طول قرنها شبیهسازی میکند. این ابزار برخلاف…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۰۹۶ مقاله منتشر شده

سید علیرضا حسینی المدرسیه یک آزمایشگاه متنباز را معرفی کرد که با استفاده از معماری ماشین حالت، اثر مداخلات کوچک تاریخی را در طول قرنها شبیهسازی میکند. این ابزار برخلاف…

یک چارچوب جدید با معرفی «نقشههای منبع» و «گزارشهای کاری»، مرز میان پیشنویسهای هوش مصنوعی و منابع تأییدشده را تفکیک میکند. این متد مانع از جایگزینی پژوهش واقعی با توهمات…

یک نسخه پژوهشی از مدل Claude موفق شد یکی از قدیمیترین مسائل نظری عدد را با افزایش کران پایین تابع زتای ریمان از ۴۱.۶٪ به ۶۷.۲٪ به پیش ببرد. این مدل هرچند فرضیه ریمان را بهطور…

شرکت Dyna Robotics با معرفی مدل DYNA-2، یادگیری مهارتهای فیزیکی رباتها را از دادههای گرانقیمت رباتیک به ویدیوهای انسانی منتقل کرد. این مدل با تماشای میلیونها ساعت رفتار…

یک متدولوژی جدید برای کاوش دادهها نشان میدهد که GPT-5.6 آموزش خود را در فوریه ۲۰۲۶ به پایان رسانده، در حالی که Claude Opus 5 برخلاف ادعاهای رسمی، دانشی مشابه مدلهای قدیمیتر…

تجربه یک توسعهدهنده از عاملهای پژوهشی خودکار نشان میدهد که این سیستمها میتوانند نتایجی با دقت آماری بالا تولید کنند که در واقع حاصل باگهای پنهان هستند. این مورد هشدار میدهد…

متا مدل Muse Glimmer را به عنوان یک مدل وزنباز ۳۰ میلیارد پارامتری برای اجرای محلی عاملهای هوش مصنوعی منتشر کرد. این مدل با استفاده از کوانتش ۴ بیتی و رمزگشایی گمانهزنانه، روی…

موج جدیدی از استارتاپها در تلاشاند تا معماری استاندارد ترنسفورمر را جایگزین کنند تا هزینههای سرسامآور انرژی و محدودیتهای پنجره متنی را حل کنند. این شرکتها با استفاده از…

یک توسعهدهنده کنترل کامل یک حساب بورس را به یک عامل هوش مصنوعی سپرد تا در ۳۰ روز سرمایه را دو برابر کند. این آزمایش بررسی میکند که آیا مدلهای زبانی میتوانند با یادگیری از…

تیمهای توسعه در سال ۲۰۲۶ از انتخاب میان اسکریپتهای قطعی و عاملهای هوش مصنوعی دست کشیدهاند. آنها اکنون از معماری ترکیبی استفاده میکنند که در آن Playwright وظایف پایدار را بر…

گوگل حالت استدلال کند Gemini Deep Think را برای حل مسائل پیچیده علمی و ریاضی عرضه کرد. این قابلیت با اولویت دادن به دقت بر سرعت، توانسته است در آزمونهای سخت ریاضیات و…

لورنتیو راداکو با طراحی یک گردشکار جدید، مدلهای زبانی را از نقش «معلم متنی» به «مهندس نرمافزار» تغییر داد تا مفاهیم پیچیده فنی را در قالب شبیهسازهای بصری و بازیگونه آموزش دهد.