
Kimi K2.6: مدل وزنبازی که در کدنویسی GPT-5.5 و Claude را شکست داد
مدل Kimi K2.6 از شرکت Moonshot AI با معماری MoE توانست در بنچمارکهای کدنویسی از مدلهای بسته و قدرتمندی مثل GPT-5.5 پیشی بگیرد. این اتفاق نشان میدهد شکاف عملکردی بین مدلهای…
موضوع
Open-source models, open weights, local hosting, licensing
۲٬۰۳۸ مقاله منتشر شده

مدل Kimi K2.6 از شرکت Moonshot AI با معماری MoE توانست در بنچمارکهای کدنویسی از مدلهای بسته و قدرتمندی مثل GPT-5.5 پیشی بگیرد. این اتفاق نشان میدهد شکاف عملکردی بین مدلهای…

انویدیا راهنمایی عملی برای بهینهسازی مدل جهانی Cosmos Predict 2.5 با استفاده از LoRA و DoRA منتشر کرد. این روش اجازه میدهد توسعهدهندگان بدون هزینههای سنگین آموزش کامل،…

نسخه ۳.۵ ابزار PaddleOCR اکنون امکان اجرای مدلهای پردازش اسناد را در بستر Transformers فراهم کرده است. این تغییر، یکپارچهسازی مدلهای OCR را برای توسعهدهندگانی که از اکوسیستم…

پایتورچ یک ابزار آزمایشی به نام MLX Delegate را برای ExecuTorch منتشر کرد که سرعت اجرای مدلهای هوش مصنوعی زاینده را در مکهای اپل سیلیکون تا ۶ برابر افزایش میدهد. این ابزار با…

لینوس توروالدز هشدار داد که ابزارهای هوش مصنوعی با تولید انبوه گزارشهای تکراری، سیستم امنیتی لینوکس را فلج کردهاند. او از پژوهشگران خواست به جای گزارشهای سطحی، وصلههای اصلاحی…

یک راهنمای فنی جدید نشان میدهد که مدل Gemma 4 26B گوگل را میتوان با استفاده از vLLM و کوانتایزیشن ۴-بیتی AWQ روی یک GPU مدل L4 اجرا کرد. این پیکربندی جایگزینی خصوصی و سریع برای…

OpenClaw پس از ممنوعیت OAuth توسط Anthropic وارد وضعیت نگهداری شد. Nous Research با انتشار نسخه v0.14 ابزار Hermes Agent، امکان انتقال خودکار حافظه و مهارتها به یک معماری…

پلتفرم LiteLLM Agent از BerriAI به صورت بازمتن منتشر شد تا جلسات عاملهای هوش مصنوعی در برابر ریاستارتهای سرور مقاوم شوند. این ابزار با استفاده از سندباکسهای کوبرنتیز، محیطهای…

مهندسان اکنون میتوانند با تغییر فعالسازهای داخلی مدلهای زبانی، خروجیها را هدایت کنند. انتشار DeepSeek-V4-Flash و ابزار DwarfStar 4 این روش را برای کدنویسی عاملمحور کاربردی…

انویدیا مدل SANA-WM را با ۲.۶ میلیارد پارامتر معرفی کرد که قادر است ویدیوهای یک دقیقهای با کیفیت 720p را روی یک GPU تولید کند. این مدل با جایگزینی مکانیزم توجه استاندارد با Gated…

معیار جدید WorldReasonBench نشان میدهد که مدلهای تجاری تولید ویدیو در استدلال جهانی دو برابر قدرتمندتر از رقبای بازمتن هستند. با این حال، تمامی مدلهای بررسیشده در درک مفاهیم…

چارچوب جدید Orthrus سرعت استنتاج مدلهای Qwen3 را تا ۷.۸ برابر افزایش میدهد بدون اینکه دقت پاسخها کاهش یابد. این سیستم مدلهای پیشنویس سنگین را با یک معماری انتشار دو-نمایی…