
الگوریتمهای بهینهساز در برابر روترهای ساده در مدیریت حافظهٔ مدلها
رویکردهای ساده برای توزیع وظایف بین مدلهای ارزان و گران بهدلیل نادیده گرفتن زیرساخت و حافظه موقت، هزینهها را افزایش میدهند. جایگزینی این روش با الگوریتمهای بهینهساز…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۸۸ مقاله منتشر شده

رویکردهای ساده برای توزیع وظایف بین مدلهای ارزان و گران بهدلیل نادیده گرفتن زیرساخت و حافظه موقت، هزینهها را افزایش میدهند. جایگزینی این روش با الگوریتمهای بهینهساز…

شرکت Pantograph مدلی با ۴ میلیارد پارامتر به نام Pan توسعه داده که بدون نیاز به دادههای برچسبگذاریشده، تنها از طریق تماشای ویدیوهای اینترنتی، رفتارهای هدفمند را یاد میگیرد.…

شرکت OpenAI با همکاری Work Louder سختافزار Codex Micro را برای مدیریت مستقیم عاملهای هوش مصنوعی معرفی کرد. این دستگاه با استفاده از کلیدهای مکانیکی و پیچهای چرخشی، امکان تنظیم…

پژوهشهای جدید نشان میدهد بردارهای هدایت (Steering Vectors) یک مدل زبانی را میتوان با یک چرخش ریاضی ساده به مدل دیگری از خانوادهای متفاوت منتقل کرد. این یافته ثابت میکند…

شرکت OpenAI در بازرسی از محک کدنویسی SWE-Bench Pro دریافت که حدود ۳۰ درصد از سناریوهای آن دارای نقص فنی هستند. این شرکت به دلیل عدم اطمینان به نتایج، توصیه به استفاده از این…

بهینهسازی تولید زبان طبیعی نیازمند موازنه بین زمان تا نخستین توکن و تأخیر بینتوکنی است. استفاده از معماری ترکیب خبرهها اجازه میدهد عمق استدلال مدل حفظ شود و در عین حال توان…

استفاده از زبانهای تخصصی (DSL) با محدود کردن فضای خروجی مدلها، احتمال توهم را حذف و صحت سینتکسی را تضمین میکند. این رویکرد به توسعهدهندگان اجازه میدهد حلقههای خودکارسازی…

پلتفرم Oxlo.ai با جایگزینی مدل پرداخت توکنی با هزینه ثابت بهازای هر درخواست، مانع اقتصادی تحلیل فایلهای لاگ حجیم را از بین برد. این رویکرد امکان استدلال عمیق روی دادههای…

مدلهای زبانی مدرن بین دو مسیر معماری متراکم و ترکیب خبرهها (MoE) تقسیم شدهاند. در حالی که مدلهای متراکم از تمام توان خود برای هر پاسخ استفاده میکنند، MoE تنها بخشهای تخصصی…

شرکت OpenAI ارتباطات بین عاملهای هوش مصنوعی در ابزار Codex را رمزگذاری کرد تا توسعهدهندگان نتوانند روند تفویض تکالیف را ببینند. گمان میرود این اقدام برای جلوگیری از استخراج…

گزارش جدید OpenAI نشان میدهد بسیاری از جدولهای رتبهبندی کدنویسی بهدلیل تداخل دادههای آموزشی و آزمون غیرقابلاعتماد هستند. این تحلیل تأکید میکند که نمرات بدون بررسی دقیق نشت…

گوگل دیپمایند یک مربی هوش مصنوعی برای آزمایشگاههای Atal Tinkering Labs معرفی کرد که بهجای ارائه پاسخهای سریع، اولویت را به تفکر مستقل دانشآموز میدهد. این سامانه با استفاده…