
آیا میتوان حافظهٔ ایندکسهای برداری را بدون افت کیفیت کاهش داد؟
استفاده از کوانتش باینری میتواند فضای ذخیرهسازی ایندکسهای برداری را تا ۳۲ برابر کاهش دهد و ۹۶٪ از کیفیت بازیابی را حفظ کند. موفقیت این روش به شدت به پیادهسازی صحیح…
موضوع
SLMs, on-device inference, mobile AI, AI PCs
۱٬۷۷۳ مقاله منتشر شده

استفاده از کوانتش باینری میتواند فضای ذخیرهسازی ایندکسهای برداری را تا ۳۲ برابر کاهش دهد و ۹۶٪ از کیفیت بازیابی را حفظ کند. موفقیت این روش به شدت به پیادهسازی صحیح…

کوانتش یکپارچه در مدلهای بینایی-زبانی (VLM) منجر به تخریب شدید دقت بصری میشود. با حفظ دقت کامل در برج بینایی و لایه سازگارساز و کوانتش تنها در بدنه زبانی، میتوان حافظه را به…

یک راهنمای فنی جدید، خط لولهای جامع برای آموزش مدلهای زبانی کوچک در استفاده از ابزارهای خارجی ارائه داده است. این فرآیند با استفاده از مجموعه داده XYZ-Aquila-SFT و آداپتورهای…

یک توسعهدهنده مستقل با عرضه Local Waifu، مدل جدیدی از همراهان هوش مصنوعی را معرفی کرد که تماماً روی سختافزار کاربر اجرا میشود. این پروژه پاسخی است به نگرانیهای مربوط به سانسور…

پلتفرم Deltix با عرضه نسخه بتای باز، امکان تست اپلیکیشنهای iOS را از طریق دستورات انگلیسی ساده فراهم کرد. این ابزار با استفاده از یک عامل محلی، جریانهای کاری کاربر را در…

پلتفرم Artwaste.land سیستمی را طراحی کرده که جستوجوی معنایی ۷۹۶ صفحه را بهطور کامل در مرورگر کاربر و بدون نیاز به سرور یا پایگاهداده برداری اجرا میکند. این معماری با تبدیل…

شرکت چینی Unitree با عرضه مدل ارزانقیمت G1، دسترسی به رباتهای انساننما را برای عموم فراهم کرد. این ماشینها اکنون به ابزاری برای تولید محتوای ویروسی در شبکههای اجتماعی تبدیل…

یک حفره امنیتی سطح بالا در قابلیت Screen Sharing سیستمعامل macOS شناسایی شده که به مهاجمان اجازه میدهد بدون رمز عبور، دسترسی ریشه (Root) به سیستم پیدا کنند. اپل برای نسخههای…

یک پیادهسازی عملی نشان میدهد مکمینی M4 با ۱۶ گیگابایت رم میتواند یک دستیار کدنویسی کاملاً آفلاین را اجرا کند. با تقسیم وظایف بین مدلهای ۷ میلیاردی و ۱.۵ میلیاردی،…

متا مدل Glimmer را با وزنهای باز برای اجرا روی سختافزار شخصی عرضه کرد. مارک زاکربرگ در مانیفست جدید خود بر دموکراتیزه کردن AI تأکید دارد، اما منتقدان این اقدام را تضادی با…

علیبابا با انتشار سری Qwen3.8، مدلهای چندوجهی بسیار کارآمد ۲۷ میلیاردی و یک نسخه غولپیکر ۲.۴ تریلیون پارامتری را در دسترس قرار داد. این مدلها با مجوز Apache 2.0 منتشر شدهاند…

تحلیل دادههای سال ۲۰۲۶ نشان میدهد مرکز ثقل مدلهای با وزن باز به شرق منتقل شده و چین اکنون بر مدلهای مقیاس تریلیونی تسلط دارد. در مقابل، شرکتهای آمریکایی استراتژی خود را به…