
پایان کابوس هزینههای تصاعدی؛ Burnless و انقلاب در اقتصاد عاملهای هوش مصنوعی
پروتکل جدید Burnless با تبدیل هزینههای تصاعدی به خطی، مصرف API را در سیستمهای عاملمحور تا ۹۰٪ کاهش میدهد. این ابزار با ترکیب حافظه پیشوند و تاریخچههای فشرده، مسیر…
موضوع
Open-source models, open weights, local hosting, licensing
۲٬۰۳۶ مقاله منتشر شده

پروتکل جدید Burnless با تبدیل هزینههای تصاعدی به خطی، مصرف API را در سیستمهای عاملمحور تا ۹۰٪ کاهش میدهد. این ابزار با ترکیب حافظه پیشوند و تاریخچههای فشرده، مسیر…

گوگل با معرفی Gemma 4 و پلتفرم Gemini Enterprise، تمرکز خود را از چتباتهای ساده به «عاملهای هوشمند» تغییر داده است. این تحول، اتوماسیون فرآیندهای پیچیده تجاری و پژوهشی را برای…

مدل Granite 4.1 8B ثابت کرد که با اولویت دادن به کیفیت دادهها میتوان به عملکرد مدلهای ۳۲ میلیاردی رسید. این دستاورد از طریق یک فرآیند سختگیرانه پالایش داده و پنج مرحله…

پروژهی Stigmem v1.0 با معرفی یک بستر دانش فدرال، مشکل پراکندگی حافظه در سیستمهای چندعاملی را حل میکند. این سیستم با تقلید از رفتار مورچهها، امکان اشتراکگذاری حقایق تاییدشده…

پروژهی جدیدی به نام deepclaude امکان استفاده از قابلیتهای عاملمحور Claude Code را با جایگزینی مدل ارزانقیمت DeepSeek V4 Pro فراهم کرده است. این ابزار هزینههای عملیاتی را بدون…

پلتفرم Thoth با معرفی معماری محلی-محور، مفهوم «حاکمیت هوش مصنوعی» را به واقعیت تبدیل کرده است. این ابزار با انتقال حافظه از ابر به لبه، کنترل کامل دادهها را به کاربر بازمیگرداند.

شیائومی با معرفی MiMo-V2.5-Pro، بازی را برای مدلهای کدنویسی تغییر داد. این مدل با وزنهای باز، عملکردی مشابه Claude Opus 4.6 دارد اما با مصرف توکن بهمراتب کمتر.

ابزار Trooper با ایجاد یک پروکسی سبک، مشکل قطع شدن گفتگوها هنگام اتمام سهمیه (Quota) مدلهای ابری را حل میکند. این ابزار با استراتژی فشردهسازی سهلایه، بافت گفتگو را هنگام…

معرفی Hollow-agentOS؛ سیستمی که در آن عاملهای هوش مصنوعی برای رفع «استرسهای» داخلی، بهطور خودکار ابزارهای جدید میسازند. این رویکرد، کاربر انسانی را از یک رئیس به یک لایهی…

تیم Qwen با معرفی FlashQLA، سرعت پردازش در مدلهای زبانی بزرگ را تا ۳ برابر افزایش داد. این کتابخانه با بهینهسازی مکانیسم توجه در پردازندههای NVIDIA Hopper، هزینهی محاسباتی…

مدل Mistral Medium 3.5 با ۱۲۸ میلیارد پارامتر، مرز بین مدلهای استدلالی و کدنویسی را از بین برد. این مدل متراکم، پایداری عملیاتی را جایگزین تخصصهای پراکنده کرد تا یک ابزار…

پایتورچ با معرفی AutoSP، فرآیند پیچیدهی موازیسازی توالیها را خودکار کرد. این ابزار اجازه میدهد مدلهای زبانی بزرگ با کانتکستهای ۱۰۰ هزار توکنی بدون نیاز به بازنویسی دستی کد…