
آیا ابزار رایگان ZML وابستگی شرکتها به تراشههای انویدیا را میشکند؟
استارتاپ فرانسوی ZML ابزاری رایگان برای بهینهسازی استنتاج مدلهای زبانی بزرگ ارائه کرده است که سرعت اجرا را روی تراشههای مختلف از انویدیا تا اپل یکسان میکند. این اقدام هزینه…
موضوع
Open-source models, open weights, local hosting, licensing
۲٬۰۵۲ مقاله منتشر شده

استارتاپ فرانسوی ZML ابزاری رایگان برای بهینهسازی استنتاج مدلهای زبانی بزرگ ارائه کرده است که سرعت اجرا را روی تراشههای مختلف از انویدیا تا اپل یکسان میکند. این اقدام هزینه…

انویدیا و هانینگفیس با ادغام مدل GR00T 1.7 و یک مجموعه داده عظیم در کتابخانه LeRobot، دسترسی به آموزش هوش مصنوعی فیزیکی را تسهیل کردند. این اقدام در حالی رخ میدهد که ریسکهای…

انویدیا مدل Audex را معرفی کرد؛ یک مدل ۳۰ میلیارد پارامتری که بدون کاهش توان استدلالی، صوت و متن را پردازش میکند. این مدل یکی از معدود مدلهای وزنباز است که میتواند صداهای…

Smar Studio پلتفرمی است که استقرار مدلهای بازمتن (Open-source) را بر روی سختافزار شخصی کاربر و از طریق یک عامل هوشمند تسهیل میکند. این ابزار هزینههای سنگین راهاندازی زیرساختی…
پلتفرم GPUStack سامانه جامع ردیابی مصرف را برای حذف اتلاف منابع در خوشههای پردازشی مشترک عرضه کرد. این ابزار امکان تفکیک دقیق هزینههای توکن، زمان اجرای GPU و فضای ذخیرهسازی را…

پروژه Fortress با تغییر مستقیم کد C++ در موتور کرومیوم، اثرانگشتهای دیجیتالی که باعث شناسایی اتوماسیون میشوند را حذف کرده است. این رویکرد برخلاف متدهای مبتنی بر جاوااسکریپت، در…

یک الگوی عملیاتی جدید پیشنهاد میکند درخواستهای ساده به مدلهای محلی و استدلالهای پیچیده به APIها سپرده شوند. این استراتژی بر تطبیق مدلهای وزنباز مانند Gemma 4 با حافظهٔ…

شرکت Hugging Face و Amazon SageMaker AI با ادغام لینکهای مستقیم، مسیر انتقال مدلها از مرحلهٔ اکتشاف به استقرار یا تنظیم دقیق را به یک گام کاهش دادند. این بهروزرسانی…

شرکت Liquid AI ابزار متنباز Antidoom را برای حذف «حلقههای مرگ» یا تکرارهای بیپایان در مدلهای استدلالی معرفی کرد. این روش با بازآموزی تنها اولین توکنی که باعث تکرار میشود،…

Rowboat یک دستیار عاملمحور متنباز است که دادههای ایمیل، جلسات و کدها را در یک گراف دانش محلی ذخیره میکند. این سیستم برخلاف مدلهای رایج، حافظهای قابل ویرایش در قالب فایلهای…

یک ادغام استراتژیک بین SkyPilot و Hugging Face، امکان اجرای مدلهای هوش مصنوعی روی هر کلاودی را فراهم میکند در حالی که دادهها در Hub ذخیره میشوند. این اقدام هزینههای گزاف…

مدل DiffusionGemma با وجود سرعت ۴ برابری نسبت به نسلهای قبل، بهدلیل یک اختلاف فنی در پروژه llama.cpp برای کاربران ابزارهای Ollama و LM Studio در دسترس نیست. در حال حاضر تنها…