پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۲۴۷ مقاله منتشر شده

فشرده‌سازی ۶ برابری تفکر: مایکروسافت چگونه هزینه استنتاج را کاهش داد؟
آموزش کاربردی

فشرده‌سازی ۶ برابری تفکر: مایکروسافت چگونه هزینه استنتاج را کاهش داد؟

مایکروسافت با معرفی OpenMementos، روشی برای جایگزینی استدلال‌های طولانی با خلاصه‌های فشرده ارائه کرد. این متد مصرف توکن‌ها را تا ۶ برابر کاهش می‌دهد بدون آنکه دقت مدل در مسائل…

۲ دقیقه خواندن
رمزگشایی از AGI روی CPU: وقتی معماری بر قدرت محاسباتی پیروز می‌شود
آموزش کاربردی

رمزگشایی از AGI روی CPU: وقتی معماری بر قدرت محاسباتی پیروز می‌شود

یک توسعه‌دهنده ادعا کرده است که توانسته معماری AGI را به نسخه‌ای فشرده تبدیل کند که روی CPU لپ‌تاپ‌های معمولی اجرا می‌شود. این پروژه با به چالش کشیدن قوانین مقیاس‌پذیری، نشان…

۳ دقیقه خواندن
جادوی ۴۴۰ مگابایتی تنسنت برای شکست دادن گوگل ترنسلیت

جادوی ۴۴۰ مگابایتی تنسنت برای شکست دادن گوگل ترنسلیت

تنسنت یک مدل ترجمه فوق‌فشرده و آفلاین را معرفی کرد که با حجم تنها ۴۴۰ مگابایت، کیفیتی در سطح سیستم‌های تجاری بزرگ دارد. این مدل ۳۳ زبان را پشتیبانی می‌کند و نیاز به اتصال ابری را…

۲ دقیقه خواندن
پایان سلطه‌ی مدل‌های حجیم: چگونه Granite 4.1 قواعد بازی را تغییر داد

پایان سلطه‌ی مدل‌های حجیم: چگونه Granite 4.1 قواعد بازی را تغییر داد

IBM با معرفی خانواده‌ی Granite 4.1 ثابت کرد که مدل‌های کوچک‌تر با داده‌های باکیفیت می‌توانند مدل‌های غول‌پیکر را شکست دهند. نسخه‌ی ۸ میلیاردی این مدل در بنچمارک‌های کلیدی، عملکرد…

۳ دقیقه خواندن
چگونه HalluCiteChecker توهمات ارجاعات علمی را در چند ثانیه شکار می‌کند

چگونه HalluCiteChecker توهمات ارجاعات علمی را در چند ثانیه شکار می‌کند

پژوهشگران ابزار متن‌باز HalluCiteChecker را برای شناسایی ارجاعات جعلی در مقالات علمی معرفی کردند. این ابزار سبک، بدون نیاز به GPU و به‌صورت آفلاین روی CPUهای معمولی اجرا می‌شود تا…

۲ دقیقه خواندن