
سازوکار KVarN برای افزایش ۵ برابری ظرفیت حافظه در vLLM بدون افت سرعت
KVarN با حذف تضاد سنتی میان سرعت و دقت، ظرفیت حافظه KV-cache را ۳ تا ۵ برابر افزایش میدهد. این ابزار جدید اجازه میدهد مدلها بافتهای بسیار طولانیتر را بدون کاهش سرعت استنتاج…
دستهبندی
راهنماهای گامبهگام، دورهها و آموزشهای کاربردی استفاده از هوش مصنوعی — از مهندسی پرامپت تا فاینتیون و RAG.
۷٬۶۰۷ مقاله منتشر شده

KVarN با حذف تضاد سنتی میان سرعت و دقت، ظرفیت حافظه KV-cache را ۳ تا ۵ برابر افزایش میدهد. این ابزار جدید اجازه میدهد مدلها بافتهای بسیار طولانیتر را بدون کاهش سرعت استنتاج…

انویدیا مدل Nemotron 3.5 ASR را با ۶۰۰ میلیون پارامتر معرفی کرد که تبدیل گفتار به متن را برای ۴۰ زبان در لحظه انجام میدهد. این مدل با معماری جدید خود، تضاد میان سرعت و دقت را از…
پلتفرم ServiceNow-AI ابزار EVA-Bench 2.0 را برای سنجش دقیق عاملهای صوتی در حوزههای بهداشت، فناوری اطلاعات و هواپیمایی منتشر کرد. این بنچمارک با معرفی ۲۱۳ سناریوی اعتبارسنجیشده،…
پلتفرم متنباز OpenJarvis از دانشگاه استنفورد و آزمایشگاههای Lambda، امکان اجرای عاملهای هوش مصنوعی را بهصورت کاملاً محلی فراهم میکند. این سیستم با دقت نزدیک به مدلهای ابری،…
نسخهی 0.8.0 ابزار akm با معرفی «حافظهی آگاه به باور»، از جایگزینی حقایق تأییدشده توسط انسان با دادههای قدیمی یا توهمات عاملها جلوگیری میکند. این سیستم با استفاده از حالتهای…
ابزار متنباز Sandboxed محیطهای کدنویسی ایزوله را برای عاملهای هوش مصنوعی فراهم میکند. این سیستم با جایگزینی کلاسترهای پیچیده با یک کنترلپل Go، هزینههای حافظه را به شدت کاهش…
ابزار Mnemo یک لایهی حافظه محلی است که با استفاده از SQLite، گراف دانشی دائمی برای مدلهای زبانی ایجاد میکند. این سیستم با سرعت کمتر از ۵۰ میلیثانیه، با مدلهای OpenAI،…
عاملهای خودکار هنگام خطای تجزیه-وتحلیل خروجی، در حلقههای تکرار بیپایان میافتند که میتواند هزاران دلار هزینه ایجاد کند. سازوکار جدیدی در سطح درگاه (gateway) با شناسایی…
مدل Ideogram 4.0 با قابلیت رزولوشن 2K و بهبود چشمگیر در رندر متن به صورت مدل با وزنهای باز منتشر شد. این مدل اکنون در صدر جدول DesignArena قرار دارد و کنترل دقیق طراحی را به…
پلتفرم **Hyper** با تبدیل ارتباطات پراکنده شرکتی به یک گراف دانش پویا، مشکل فراموشی یا بهروز نبودن دادهها در عاملهای هوش مصنوعی را حل میکند. این سیستم اجازه میدهد حقایق جدید…
زپیر کتابخانهای از «مهارتهای عامل» را متنباز کرد تا تیمهای عملیاتی را از پرامپتنویسی ساده به جریانهای کاری مبتنی بر داده منتقل کند. این چارچوب با اتصال عاملهای هوش مصنوعی…
گوگل مدل Gemma 4 12B را منتشر کرد؛ مدل چندوجهی میاناندازهای که بدون نیاز به انکودرهای مجزا، صدا و تصویر را پردازش میکند. این مدل با مجوز آپاچی ۲.۰، برای اجرا روی سختافزارهای…