
پلتفرم Unsloth: اجرای مدل ۷۴۴ میلیارد پارامتری روی سختافزار خانگی
پلتفرم Unsloth با عرضه نسخههای کوانتیزه GLM-5.2، اجرای مدل ۷۴۴ میلیارد پارامتری Z.ai را روی سختافزارهای مصرفکننده ممکن کرد. این بهروزرسانی فضای دیسک را از ۱.۵۱ ترابایت به ۲۱۷…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۳ مقاله منتشر شده

پلتفرم Unsloth با عرضه نسخههای کوانتیزه GLM-5.2، اجرای مدل ۷۴۴ میلیارد پارامتری Z.ai را روی سختافزارهای مصرفکننده ممکن کرد. این بهروزرسانی فضای دیسک را از ۱.۵۱ ترابایت به ۲۱۷…

هوش مصنوعی در انجام تکالیفی که پاسخهای قابلسنجش دارند بیرقیب است، اما نمیتواند تعیین کند چه چیزی «ارزش خواستن» دارد. توانایی چارچوببندی سؤالات و اعمال سلیقه، همچنان مزیت…

شرکت xAI با افزودن حالت /goal به ابزار Grok Build، امکان برنامهریزی و اجرای خودکار وظایف پیچیده کدنویسی را فراهم کرد. این سیستم برخلاف پرامپتهای معمولی، تا زمان تأیید نهایی کد…

بوریس چرنی، خالق Claude Code، معتقد است عصر «حلقهها» (Loops) آغاز شده است؛ جایی که عاملهای هوش مصنوعی در چرخهای مداوم، یکدیگر را برای بهینهسازی کد هدایت میکنند. این رویکرد،…

عاملهای کدنویسی در تکمیل پروژههای پیچیده Swift شکست میخورند زیرا نمیتوانند قصد کاربر (Intent) را ارزیابی کرده یا تداخلهای زمان اجرا را مدیریت کنند. این نقص باعث ایجاد «تلهٔ…

پژوهشگران پیوندی ریاضیاتی میان درختهای تصمیم سلسلهمراتب و فرآیندهای انتشار یافتهاند. این یکپارچهسازی با معرفی یک اصل بهینهسازی مشترک، سرعت تولید دادههای جدولی را افزایش داده…

شرکت Sakana AI مدل Fugu را معرفی کرد؛ سامانهای از سازماندهی مدلها که وظایف را میان مجموعهای از مدلهای پیشرو توزیع میکند. نسخه Ultra این سیستم در استدلالهای پیچیده و…

تحقیقات جدید نشان میدهد مدلهای زبانی بزرگ تفاوت میان «برچسبهای ساختاری» و «سبک نوشتاری» را تشخیص نمیدهند. این نقص ساختاری به مهاجمان اجازه میدهد با تقلید از لحن استدلالی مدل،…

انویدیا چارچوب جامع Halos را برای تضمین ایمنی خودروهای خودران از ابر تا خودرو معرفی کرد. این سیستم با ارائه یک سیستمعامل گواهینامهدار و نخستین آزمایشگاه بازرسی معتبر جهانی، مسیر…

یک راهنمای جامع نشان میدهد چگونه میتوان چتباتهای هوش مصنوعی را از حالت «قطعیت اشتباه» به حالت «تحلیل متوازن» برد. با درخواست صریح برای بیان عدم قطعیت و استدلال، نتایج عیبیابی…

پلتفرم LayerLens مسابقات Stratix Cup را برای سنجش توانمندیهای عاملمحور مدلهای هوش مصنوعی آغاز کرد. در این رقابت، ۱۶ مدل برتر باید با نوشتن کد در لحظه و اصلاح استراتژی در بین دو…

مجموعهای از ۱۰ ابزار هوش مصنوعی، یادگیری توسعه وب را از تولید کد ساده به درک عمیق مفاهیم تغییر میدهند. این ابزارها با رویکرد «مربی» به جای «میانبر»، از اشکالزدایی در محیط…