
مدلهای MLX: حذف ۱۰۰ درصدی ریسکهای حریم خصوصی در دفاتر حقوقی
کوانتایز کردن مدلهای با وزنهای باز برای سختافزار اپل سیلیکون، امکان اجرای هوش مصنوعی را بهصورت کاملاً آفلاین فراهم میکند. این رویکرد ریسکهای حریم خصوصی مدلهای ابری، مانند…
موضوع
Open-source models, open weights, local hosting, licensing
۱٬۹۳۸ مقاله منتشر شده

کوانتایز کردن مدلهای با وزنهای باز برای سختافزار اپل سیلیکون، امکان اجرای هوش مصنوعی را بهصورت کاملاً آفلاین فراهم میکند. این رویکرد ریسکهای حریم خصوصی مدلهای ابری، مانند…

شرکت Abacus.AI خانوادهٔ مدلهای Smaug را با وزنهای باز منتشر کرد که بهطور اختصاصی برای مدیریت گردشهای کاری طولانیمدت عاملمحور بهینه شدهاند. این مدلها عملکرد مدلهای پیشرو…

شرکت Feyn مدل MultiMatte را برای حذف پیشرفته پسزمینه معرفی کرد که با جایگزینی ماسکهای باینری با آلفا مت، جزئیات پیچیده مانند مو را با دقت بالا استخراج میکند. این مدل با تنظیم…

ابزار متنباز Loop Engine با استفاده از زبان Rust، فرآیند کدنویسی AI را از تولید ساده به یک چرخهٔ کامل شامل برنامهریزی، ویرایش و تأیید تبدیل میکند. این سیستم تنها زمانی تسک را…

مدل چندوجهی جدید DeepSeek با بهینهسازی حافظه موقت (KV Cache)، هزینههای استقرار عاملهای هوش مصنوعی با بستر متنی بلند را بهشدت کاهش داده است. این مدل در بنچمارکهای کدنویسی با…

شرکت Magic متدولوژی جدیدی برای پیشآموزش مدلها معرفی کرد که با کسری از توان محاسباتی، به عملکرد مدلهای پیشرو میرسد. این تیم مدعی است توانسته است با ۵۰ برابر محاسبات کمتر، به…

شرکت Mistral AI مدلهای خود را با پلتفرم دادههای Cloudera ادغام کرد تا سازمانها بتوانند هوش مصنوعی را در محیطهای کاملاً ایزوله (Air-Gapped) اجرا کنند. این همکاری بر مفهوم «هوش…

انویدیا و پالانتیر با استقرار یک پشته هوش مصنوعی حاکمیتی، زنجیره تأمین پیچیده سختافزارهای انویدیا را بهینهسازی کردند. این سیستم با آموزش مدلهای نموترون بر اساس تصمیمات خبرگان…

شرکت Qwen قیمت مدل ۱۲۲ میلیاردی خود را کاهش داد و همزمان Mistral و DeepSeek مدلهای جدیدی را عرضه کردند. این رقابت شدید، کف قیمتی استنتاج در مقیاس صنعتی را به شدت پایین میآورد.

یک پیادهسازی جدید نشان میدهد چگونه میتوان با پوشاندن API سادهی Ollama توسط FastAPI، قابلیتهای سازمانی مانند احراز هویت و اعتبارسنجی درخواستها را اضافه کرد. این روش به…

شرکت DeepSeek مدل چندوجهی V4.1-Flash را معرفی کرد که با معماری جدید رمزگذار-رمزگشا و کوانتش FP4، فشار روی حافظه HBM را در پنجرههای متنی یک میلیون توکنی بهشدت کاهش میدهد. این…

یک توسعهدهنده با تفکیک منطق عامل از ارائهدهنده مدل، هزینههای ماهانه خود را به قیمت یک فنجان قهوه کاهش داد. این معماری با استفاده از OpenCode و OpenRouter، وابستگی به یک شرکت…