
رمزگشایی از AGI روی CPU: وقتی معماری بر قدرت محاسباتی پیروز میشود
یک توسعهدهنده ادعا کرده است که توانسته معماری AGI را به نسخهای فشرده تبدیل کند که روی CPU لپتاپهای معمولی اجرا میشود. این پروژه با به چالش کشیدن قوانین مقیاسپذیری، نشان…
موضوع
Open-source models, open weights, local hosting, licensing
۲٬۰۳۶ مقاله منتشر شده

یک توسعهدهنده ادعا کرده است که توانسته معماری AGI را به نسخهای فشرده تبدیل کند که روی CPU لپتاپهای معمولی اجرا میشود. این پروژه با به چالش کشیدن قوانین مقیاسپذیری، نشان…

مدل TinyR1-32B-Preview با وجود اندازه کوچکتر، رقیب ۷۰ میلیاردی خود را در بنچمارکهای استدلالی شکست داد. این دستاورد از طریق ترکیب متخصصهای دامنهای و استفاده از ابزار Mergekit…

بنیاد LightSeek با معرفی SMG، گلوگاههای پایتون را حذف و پردازشهای سنگین را به زبان Rust منتقل کرد. این تغییر معماری باعث شد سرعت استنتاج مدل Llama-3.3 تا ۳.۵ برابر افزایش یابد.

یک توسعهدهنده طی ۱۸ ماه، موتور کامل ترنسفورمر را از صفر با زبان C بازنویسی کرد. TRiP امکان آموزش و استنتاج مدلهایی مثل Llama 2 را بدون نیاز به پایتون یا فریمورکهای سنگین فراهم…

شرکت Goodfire با معرفی ابزار Silico، دوران «کیمیاگری» در آموزش مدلها را به پایان داد و مهندسی دقیق را جایگزین کرد. این پلتفرم با نقشهبرداری از نورونهای داخلی، امکان حذف توهمات…

تنسنت یک مدل ترجمه فوقفشرده و آفلاین را معرفی کرد که با حجم تنها ۴۴۰ مگابایت، کیفیتی در سطح سیستمهای تجاری بزرگ دارد. این مدل ۳۳ زبان را پشتیبانی میکند و نیاز به اتصال ابری را…

IBM با معرفی خانوادهی Granite 4.1 ثابت کرد که مدلهای کوچکتر با دادههای باکیفیت میتوانند مدلهای غولپیکر را شکست دهند. نسخهی ۸ میلیاردی این مدل در بنچمارکهای کلیدی، عملکرد…

پژوهشگران ابزار متنباز HalluCiteChecker را برای شناسایی ارجاعات جعلی در مقالات علمی معرفی کردند. این ابزار سبک، بدون نیاز به GPU و بهصورت آفلاین روی CPUهای معمولی اجرا میشود تا…

یک مدل تخصصی Qwen2.5-7B در تریاژ پزشکی از GPT-4o پیشی گرفت. این نتیجه ثابت میکند تنظیم دقیق روی دادههای بالینی بسیار موثرتر از تکیه بر مدلهای عمومی عظیم است.

پژوهشگران محیط FutureWorld را برای آموزش عاملهای هوش مصنوعی زاینده به پیشبینی رویدادهای واقعی طراحی کردهاند. این سیستم با بستن حلقهی یادگیری بین پیشبینی و نتیجه، امکان تکامل…

یک مطالعه جدید نشان میدهد که برای تصحیح دقیق تکالیف ریاضی، همراستاسازی معماری با دستورالعملها بسیار حیاتیتر از تعداد پارامترها است. در حالی که مدلهای مبتنی بر Gemini عملکرد…

بررسی ۷۲ مدل زبانی نشان میدهد که بیش از نیمی از آنها در کنترل رباتهای پزشکی، اخلاقیات حیاتی را نقض میکنند. این شکاف ایمنی، بهویژه در مدلهای وزنباز، استقرار این فناوری در…