
انویدیا: دسترسی به B300 بدون نیاز به سرمایهگذاری میلیون دلاری
شرکتهای فناوری اکنون میتوانند بدون نیاز به سرمایهگذاری میلیون دلاری برای خرید سختافزار، از قدرت GPUهای NVIDIA B300 از طریق مدلهای اجارهای استفاده کنند. این تغییر رویکرد به…
موضوع
تراشهها، پردازندهها و تجهیزات فیزیکی مورد استفاده در اجرای مدلهای هوش مصنوعی
۴۶۰ مقاله منتشر شده

شرکتهای فناوری اکنون میتوانند بدون نیاز به سرمایهگذاری میلیون دلاری برای خرید سختافزار، از قدرت GPUهای NVIDIA B300 از طریق مدلهای اجارهای استفاده کنند. این تغییر رویکرد به…

شرکت Crusoe برای گسترش زیرساختهای هوش مصنوعی و استقرار «کارخانههای AI» مدلار، ۳.۹ میلیارد دلار سرمایه جذب کرد. این جذب سرمایه ارزش شرکت را به ۳۰.۹ میلیارد دلار رسانده تا ظرفیت…

شرکت آنتروپیک با استفاده از مدل Claude، بیش از ۳۰ مدل متنباز زیستمولکولی را بهینهسازی کرد و سرعت آنها را بهطور متوسط ۴ برابر افزایش داد. این دستاورد با انتشار کیتهای…

کریس بیورز، مدیرعامل NetBox Labs، استدلال میکند که محدودیتهای فیزیکی مانند برق و خنکسازی اکنون سرعت توسعه هوش مصنوعی را تعیین میکنند. او معتقد است عاملهای هوش مصنوعی بدون یک…

شبکه عصبی جدید شرکت Figure به رباتهای انساننما اجازه میدهد بدون آموزش محیطی، کارهای خانه را در مکانهای کاملاً جدید انجام دهند. این سیستم با بهرهگیری از مجموعه داده Index، نرخ…

شرکت Crusoe با جذب ۳.۹ میلیارد دلار سرمایه و رسیدن به ارزش ۳۰.۹ میلیارد دلار، قصد دارد زنجیره ارزش هوش مصنوعی را از تولید انرژی تا استنتاج ابری بهطور کامل در اختیار بگیرد تا…

پینترست ابزار هوش مصنوعی Restyle را برای بازطراحی اتاقها از طریق عکسهای شخصی معرفی کرد. این قابلیت با تبدیل تخیلات بصری به خریدهای واقعی، مسیر تبدیل «ایده» به «کالا» را کوتاه…

یک محیط اجرای تخصصی برای مکهای اپل، مدل Gemma 4 26B را با استفاده از استریم خبرهها از حافظه SSD، تنها با ۲ گیگابایت رم فعال میکند. این ترفند مهندسی کیفیت مدلهای حجیم را به…

شرکتهای AXG و Digital Realty برای ارائه زیرساختهای ابری و هوش مصنوعی خصوصی در ۳۱ بازار جهانی متحد شدند. این مدل به سازمانها اجازه میدهد بدون درگیر شدن با هزینههای گزاف ابرهای…

هواوی با معرفی OceanStor M900، گلوگاه حافظه در عاملهای هوش مصنوعی با پنجرههای متنی بسیار بلند را حل کرد. این سامانه با ارائه حافظه مشترک در مقیاس پتابایت، تأخیر دسترسی را ۹۰٪…

فوجیتسو با معرفی پردازنده و سرور MONAKA، معماری ۳ بعدی ۲ نانومتری را برای هوش مصنوعی حاکمیتی به کار گرفت. این سیستم توان عملیاتی استنتاج را دو برابر کرده و مصرف انرژی و فضای مورد…

پلتفرم Groq با ارائه یک API با تأخیر بسیار پایین، استنتاج مدلهای زبانی را به زیر یک میلیثانیه رسانده است. این زیرساخت به توسعهدهندگان اجازه میدهد چتباتها و سرویسهای لبهای…