
Mingxin FX100 توان عملیاتی مدلهای کوچک را ۴۰٪ افزایش داد
بهینهسازی دسترسی به حافظه از طریق لایهبندی KV Cache، گلوگاه اصلی تأخیر در استنتاج مدلهای کوچک را برطرف کرد. بنچمارکهای جدید نشان میدهد که سختافزار Mingxin FX100 توان عملیاتی…
موضوع
تراشهها، پردازندهها و تجهیزات فیزیکی مورد استفاده در اجرای مدلهای هوش مصنوعی
۴۵۲ مقاله منتشر شده

بهینهسازی دسترسی به حافظه از طریق لایهبندی KV Cache، گلوگاه اصلی تأخیر در استنتاج مدلهای کوچک را برطرف کرد. بنچمارکهای جدید نشان میدهد که سختافزار Mingxin FX100 توان عملیاتی…

بنچمارکهای جدید Mingxin نشان میدهد جایگزینی NFS با آرایههای All-Flash مبتنی بر NVMe-oF، زمان بیکاری GPUها را در هنگام بارگذاری مدل بهشدت کاهش میدهد. این تغییر با بهینهسازی…

شرکت Nutanix بودجه ابزارهای کدنویسی خود را از اشتراکهای SaaS به یک خوشه GPU درونسازمانی ۲۰ میلیون دلاری تغییر داد. این اقدام نشاندهنده شکافی در حاکمیت شرکتی است که در آن…

دانیجار هافنر، پژوهشگر سابق گوگل دیپمایند، استارتاپی مخفی برای توسعه رباتهای انساننما راهاندازی کرده است. او با استفاده از یادگیری تقویتی مدلمحور، به رباتها اجازه میدهد پیش…

استارتاپ Vaire Computing سختافزاری ساخته است که انرژی تلفشده به صورت گرما را بازیابی میکند. این شرکت با طراحی یک رزوناتور جدید، تراشهای را معرفی کرد که انرژی بازیابیشدهاش…

وزارت صنعت و فناوری اطلاعات چین طرح پنجساله جدیدی را برای افزایش ۶ برابری ظرفیت محاسباتی هوش مصنوعی تا سال ۲۰۳۰ آغاز کرده است. این استراتژی شامل سرمایهگذاری ۳.۸ تریلیون یوانی در…

یک شمارندهٔ انسانی قابلاتکا به چیزی فراتر از مدل تشخیص شخص نیاز دارد. این فرآیند شامل زنجیرهای از مراحل ثبت فریم، ردیابی و مدیریت وضعیت است تا پیکسلهای خام به دادههای دقیق…

شرکت SEMIFIVE تولید انبوه تراشه Bertha را با استفاده از فناوری ۴ نانومتری سامسونگ آغاز کرد. این شتابدهنده اختصاصی برای کاهش تأخیر و هزینههای عملیاتی اجرای مدلهای زبانی بزرگ در…

استقرار عملیاتی مدل Qwen3.8-27B روی دو GPU مدل RTX 3090 نشان میدهد که مدلهای زبانی محلی اکنون قادر به مدیریت گردشکارهای پیچیده حرفهای هستند. این پیکربندی با اولویت دادن به…

شرکت Arm با معرفی GPU مدل Mali G2-Ultra NX، برای نخستین بار شتابدهندههای عصبی را مستقیماً در خط لوله گرافیکی ادغام کرد. این معماری با استفاده از هوش مصنوعی برای بازسازی تصاویر و…
شرکتهای علیبابا کلاود، کمبریکون و آنت گروپ با عضویت در بنیاد PyTorch به دنبال کاهش وابستگی به انویدیا و بهینهسازی مدلها روی تراشههای متنوع هستند. این اقدام گامی استراتژیک…

شرکت OpenAI برای تأمین ظرفیت محاسباتی در جنوب شرق آسیا، قراردادی چندساله با Firmus Technologies امضا کرد. این همکاری با استفاده از پلتفرم نسل جدید Vera Rubin انویدیا، هدفش کاهش…