
«مهاری برای مدیریت حافظه»؛ نقش اندازهٔ گروه در کوانتش مدلها
تنظیم اندازهٔ گروه (Group Size) در کوانتش، یک اهرم ریاضی برای مدیریت حافظه است، نه یک متغیر تصادفی. کاهش این اندازه با ایزوله کردن وزنهای پرت، دقت مدل را حفظ میکند اما فضای VRAM…
موضوع
Open-source models, open weights, local hosting, licensing
۱٬۹۴۷ مقاله منتشر شده

تنظیم اندازهٔ گروه (Group Size) در کوانتش، یک اهرم ریاضی برای مدیریت حافظه است، نه یک متغیر تصادفی. کاهش این اندازه با ایزوله کردن وزنهای پرت، دقت مدل را حفظ میکند اما فضای VRAM…

مدلهای زبانی بزرگ در مقیاسهای بالا «ویژگیهای پرت» ایجاد میکنند که دقت کوانتش ۸ بیتی را بهطور کامل تخریب میکند. مدیریت این مقادیر حدی، مرز میان یک مدل فشردهی کاربردی و مدلی…

فرآیند کوانتش مدلها بهدلیل نیاز به وزنهای دقتبالا و محاسبات آماری، حافظه بسیار بیشتری نسبت به استنتاج مصرف میکند. شناخت تفاوتهای حافظهای در متدهای GPTQ، AWQ و GGUF برای…

کوانتش یکپارچه در مدلهای بینایی-زبانی (VLM) منجر به تخریب شدید دقت بصری میشود. با حفظ دقت کامل در برج بینایی و لایه سازگارساز و کوانتش تنها در بدنه زبانی، میتوان حافظه را به…

یک راهنمای فنی جدید، خط لولهای جامع برای آموزش مدلهای زبانی کوچک در استفاده از ابزارهای خارجی ارائه داده است. این فرآیند با استفاده از مجموعه داده XYZ-Aquila-SFT و آداپتورهای…

یک توسعهدهنده مستقل با عرضه Local Waifu، مدل جدیدی از همراهان هوش مصنوعی را معرفی کرد که تماماً روی سختافزار کاربر اجرا میشود. این پروژه پاسخی است به نگرانیهای مربوط به سانسور…

ابزار جدید RepoTrials با تبدیل تاریخچه Git یک پروژه به تستهای رگرسیون تکرارپذیر، امکان ارزیابی دقیق مدلهای هوش مصنوعی را روی کدبیس واقعی تیمها فراهم میکند. این رویکرد جایگزینی…

محک جدید Moonshot AI نشان میدهد حتی پیشرفتهترین مدلهای چندوجهی در درک ابتدایی تصاویر ناتواناند. هیچ مدلی نتوانست از مرز ۶۰ درصد صحت در مهارتهای بصری پایه عبور کند، که ثابت…

عامل پژوهشی Mole با معرفی سیستم حسابداری دقیق و تأیید نقلقولهای مستقیم، پایان شوکهای هزینهای در استفاده از عاملهای هوش مصنوعی را رقم زد. این ابزار امکان تحلیل دادههای محلی…

مارک زاکربرگ در مانیفستی مفصل استدلال کرد که دموکراتیزه کردن فناوری AI برای جلوگیری از تمرکز قدرت ضروری است. این موضعگیری همزمان با تغییر برند اینستاگرام و تلاشهای صنعت برای…

یک پیادهسازی عملی نشان میدهد مکمینی M4 با ۱۶ گیگابایت رم میتواند یک دستیار کدنویسی کاملاً آفلاین را اجرا کند. با تقسیم وظایف بین مدلهای ۷ میلیاردی و ۱.۵ میلیاردی،…

متا مدل Glimmer را با وزنهای باز برای اجرا روی سختافزار شخصی عرضه کرد. مارک زاکربرگ در مانیفست جدید خود بر دموکراتیزه کردن AI تأکید دارد، اما منتقدان این اقدام را تضادی با…