
چگونه vLLM با بودجهبندی تفکر، استنتاج مدلهای استدلالی را بهینه کرد؟
نسخه v0.21.0 از vLLM با پشتیبانی اختصاصی از پردازندههای Blackwell برای مدل DeepSeek-R1 و معرفی «بودجه تفکر» عرضه شد. این بهروزرسانی همچنین پیشنیازهای فنی را به C++20 و…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۱۰۱ مقاله منتشر شده

نسخه v0.21.0 از vLLM با پشتیبانی اختصاصی از پردازندههای Blackwell برای مدل DeepSeek-R1 و معرفی «بودجه تفکر» عرضه شد. این بهروزرسانی همچنین پیشنیازهای فنی را به C++20 و…

استارتاپی جدید با سرمایهای ۶۵۰ میلیون دلاری به دنبال دستیابی به خودبهبودی بازگشتی است. هدف این تیم، ساخت مدلهایی است که بهطور خودکار نقاط ضعف خود را شناسایی و اصلاح کنند تا…

گوگل دیپمایند خانواده مدلهای Gemma 4 را با وزنهای باز عرضه کرد تا استدلال سطح پیشرو را به سختافزارهای محلی بیاورد. مدل ۳۱ میلیارد پارامتری این خانواده، جهشی خیرهکننده در…

مایکروسافت با استفاده از سامانه MDASH و ۱۰۰ عامل هوش مصنوعی، ۱۶ حفره امنیتی جدید در ویندوز شناسایی کرد. این سیستم با استفاده از یک سازوکار بحث و بررسی، توانست ۴ نقص بحرانی در هسته…

مدل DeepSeek-V4 با معرفی معماری Hybrid Attention، هزینه محاسباتی استنتاج در پنجرههای متنی یک میلیون توکنی را بهشدت کاهش داد. این مدل با تمرکز بر بهینهسازی عاملهای خودکار،…

مدل Claude 4.6 در کدنویسی و استدلالهای پیچیده پیشتاست، در حالی که GPT-5.4 در ابزارهای اکوسیستمی برتری دارد. برنامهنویسان اکنون بهجای جستوجوی یک مدل «بهترین»، از استراتژی…

یک سامانه ردیابی جدید با تحلیل تاریخچه امتیازات LMSYS Arena، کاهش پنهان کیفیت مدلهای برتر هوش مصنوعی را افشا کرد. این پدیده که «نرفینگ» نامیده میشود، اغلب نتیجهی سختگیرانهتر…

آندری کارپاتی چارچوب «نرمافزار ۳.۰» را معرفی کرد و استدلال میکند که زبان طبیعی و کانتکست جایگزین کدهای صریح شدهاند. در این مدل، نقش برنامهنویس از نویسندهی منطق به ارکستراتور…

پژوهش جدید Pi-Serini نشان میدهد که ترکیب بازیابی لغتمحور (BM25) با مدلهای پیشرو مانند GPT-5.5 در وظایف پژوهشی عمیق، عملکرد بهتری نسبت به سیستمهای جستجوی متراکم دارد. این سیستم…

مدل DeepSeek V4-Pro عملکردی نزدیک به مدلهای پیشرو و پنجره متنی ۱ میلیون توکنی را با کسری از هزینه GPT-5.5 ارائه میدهد. در حالی که OpenAI در گردشهای کاری عاملمحور پیشتاز است،…

توسعهدهندگان میتوانند بهجای تنظیم دقیق هزینهبر، از یک مدل بزرگتر برای تولید و امتیازدهی به پرامپتهای مدلهای لبه استفاده کنند. این روش «ارتقای مهارت پرامپت» پایداری سیستم را…

نسخه ۱.۱۲۰ ویرایشگر VS Code عاملهای هوش مصنوعی را از یک ابزار جانبی به هسته مرکزی محیط توسعه تبدیل میکند. این بهروزرسانی قابلیت برنامهریزی چندمرحلهای برای Claude و کنترل دقیق…