
۵ تنظیمات کلیدی در اولاما برای افزایش سرعت استنتاج مدلهای محلی
بسیاری از کاربران به دلیل تنظیمات پیشفرض غیربهینه، با کندی مدلهای محلی مواجه میشوند، نه به دلیل محدودیت سختافزاری. بهینهسازی حافظه و مکانیزمهای توجه میتواند سرعت و بهرهوری…
موضوع
تراشهها، پردازندهها و تجهیزات فیزیکی مورد استفاده در اجرای مدلهای هوش مصنوعی
۴۶۱ مقاله منتشر شده

بسیاری از کاربران به دلیل تنظیمات پیشفرض غیربهینه، با کندی مدلهای محلی مواجه میشوند، نه به دلیل محدودیت سختافزاری. بهینهسازی حافظه و مکانیزمهای توجه میتواند سرعت و بهرهوری…

استارتاپ Mecka AI در حال جذب سرمایه جدیدی به رهبری Sequoia Capital است تا گلوگاه دادههای دنیای فیزیکی را برای رباتهای انساننما حل کند. این شرکت با پرداخت هزینه به انسانها،…

اپل با معرفی iPhone Duo، یک دستگاه تاشو با قیمت پایه ۲۰۰۰ دلار، رسماً وارد رقابت با سامسونگ و گوگل شد. این محصول با تمرکز بر کاربران تجاری، نمایشگری بدون خط تا و یکپارچگی عمیق با…

استارتاپ Nscale با هدف آمادهسازی برای عرضه اولیه سهام (IPO) در پاییز جاری، فیدجی سیمو، مدیر سابق OpenAI و متا را به هیئتمدیره خود اضافه کرد. این شرکت اکنون در تلاش است تا…

مقیاسدهی سیستمهای RAG به میلیونها سند معمولاً منجر به هزینههای گزاف خروجی داده در ابر و فروپاشی سیستم میشود. انتقال به سرورهای اختصاصی Bare Metal و معماریهای جستوجوی…

ساعت اپل ۱۲ با معرفی قابلیت Audio Intelligence میتواند گفتگوهای محیطی را تحلیل کرده و خلاصهای از نکات کلیدی را تولید کند. این سیستم برای حفظ حریم خصوصی، پردازش را بهصورت محلی…

کمبود شدید حافظه DRAM باعث شده است انویدیا قیمت نسل جدید سرورهای هوش مصنوعی خود را تا ۱۷٪ بالا ببرد. سازمانها اکنون باید میان خرید سختافزار گرانقیمت، اجاره ابری یا مهاجرت به…

اپل برای مقابله با جعلهای هوش مصنوعی، قابلیت Reference Image را در آیفون ۱۸ پرو معرفی میکند تا هر عکس در لحظه ثبت، رمزنگاری شود. همزمان، توسعهدهندگان مستقل با سختافزارهای…

جنسن هوانگ پیشبینی میکند درآمد انویدیا تا ۶۸۰ میلیارد دلار برسد. او تأکید میکند که انویدیا دیگر یک سازنده تراشه نیست، بلکه پلتفرمی بنیادی است که در قلب هر مرکز داده و آزمایشگاه…

شرکت OpenAI به دلیل تقاضای بیسابقه برای مدل Astra، ثبتنام در طرح Pro را موقتاً متوقف کرد. این اقدام برای محافظت از زیرساختهای محاسباتی صورت گرفته، اما دسترسی به API و طرحهای…

بنچمارکهای جدید تراشه M2 نشان میدهد واحد عصبی (ANE) در محاسبات ماتریسی با وزنهای ثابت، بهطور چشمگیری از GPU و شتابدهنده AMX پیشی میگیرد. این یافتهها شکاف عمیقی را میان…

مدل بنیادی S1 به رباتها اجازه میدهد تنها با مشاهده یک ویدیو، کارهای پیچیده را بدون نیاز به آموزش مجدد یاد بگیرند. این شرکت با تکیه بر زیرساختهای انویدیا، تنها در ۱۰ ماه پس از…