درون سختافزار جدید گوگل برای اجرای محلی Gemma 3 روی تراشههای RISC-V
گوگل با معرفی برد Coral، امکان اجرای محلی مدل Gemma 3 270M را روی سختافزار RISC-V فراهم کرد. این اقدام هدفش کاهش وابستگی به ابر در گجتهای پوشیدنی و حذف هزینههای API است.
موضوع
Open-source models, open weights, local hosting, licensing
۲٬۰۴۰ مقاله منتشر شده
گوگل با معرفی برد Coral، امکان اجرای محلی مدل Gemma 3 270M را روی سختافزار RISC-V فراهم کرد. این اقدام هدفش کاهش وابستگی به ابر در گجتهای پوشیدنی و حذف هزینههای API است.
پلتفرم Biohub مدل متنباز ESMFold2 را معرفی کرد که در پیشبینی ساختار پروتئین از AlphaFold پیشی میگیرد. این ابزار با نرخ موفقیت ۸۸ درصدی، مسیر کشف داروهای ضدسرطان و بیماریهای…
همبستگی میان کیفیت و هزینه در مدلهای کدنویسی فروپاشیده است. آزمایشگاههای چینی اکنون قابلیتهای نزدیک به مدلهای پیشرو را با کسری از هزینه جایگزینهای غربی ارائه میدهند.
شرکت Cursor معماری Composer 2 را معرفی کرد؛ مدلی تخصصی برای مهندسی نرمافزار که بر پایه Kimi 2.5 ساخته شده است. این سیستم با استفاده از تکنیکهای Delta Sync و Router Replay،…
یک بنچمارک جدید از IBM و Artificial Analysis نشان میدهد که پیشرفتهترین مدلهای هوش مصنوعی در عیبیابی زیرساختهای سازمانی شکست میخورند. یافتهها حاکی از یک رابطه معکوس…
موتور استنتاج TokenSpeed با بهینهسازی حافظه و ادغام کرنلها، رکورد ۵۸۰ توکن در ثانیه را برای مدل Qwen3.5-397B روی پردازندههای NVIDIA Blackwell ثبت کرد. این پیشرفت بهویژه برای…
ربات Reachy Mini اکنون میتواند تمام مراحل تبدیل گفتار به گفتار را بهصورت محلی اجرا کند. این تغییر نیاز به سرورهای ابری و کلیدهای API را حذف کرده و حریم خصوصی کامل و هزینه صفر…
کتابخانه TRL متعلق به Hugging Face اکنون از همگامسازی وزنهای دلتا پشتیبانی میکند. این قابلیت با ارسال تنها پارامترهای تغییریافته، نیاز به پهنای باند را به شدت کاهش داده و…
علیبابا کلاود برای بهینهسازی زیرساختهای هوش مصنوعی در سختافزارهای مختلف، به عضویت پلاتینیوم بنیاد PyTorch درآمد. این اقدام به شرکت اجازه میدهد تا با حضور در هیئتمدیره،…
یک اسکریپت C# با استفاده از SDK ابزار Cadenza.Agent، امکان اتصال Codex CLI به مدلهایی مثل Claude 3.5 و Llama را فراهم میکند. این روش با ایجاد یک پروکسی برای APIهای OpenAI،…
EAGLE 3.1 با رفع مشکل «لغزش توجه»، سرعت استنتاج مدلهای زبانی را بهویژه در متون طولانی بهشدت افزایش میدهد. این بهروزرسانی در مدل Kimi K2.6 توانست نرخ خروجی را تا ۲ برابر بهبود…
یک خط لوله (Pipeline) جدید برای آموزش مدلهای بینایی-زبانی معرفی شده است که به جای تکیه بر حدسهای هوش مصنوعی، از اثباتهای ریاضی برای پاداشدهی استفاده میکند. این روش با ترکیب…