
حافظه مجازی در برابر تخصیص ایستا در مدیریت KV-Cache
مهندسی استنتاج از تخصیص حافظه ایستا به سمت سیستمهای حافظه مجازی حرکت میکند تا از هدررفت VRAM جلوگیری کند. پیادهسازی PagedAttention و دستهبندی پیوسته، تکهتکه شدن حافظه را حذف…
موضوع
تراشهها، پردازندهها و تجهیزات فیزیکی مورد استفاده در اجرای مدلهای هوش مصنوعی
۴۵۶ مقاله منتشر شده

مهندسی استنتاج از تخصیص حافظه ایستا به سمت سیستمهای حافظه مجازی حرکت میکند تا از هدررفت VRAM جلوگیری کند. پیادهسازی PagedAttention و دستهبندی پیوسته، تکهتکه شدن حافظه را حذف…

شرکت اکسیس با ترکیب تراشههای تخصصی و مدلهای بهینه، پردازش دادهها را از ابر به داخل دوربینها منتقل کرده است. این تغییر باعث کاهش شدید تأخیر و هزینههای پهنای باند در سیستمهای…

شرکت GMEX Robotics با تغییر استراتژی از یکپارچگی عمودی به مدل «ترمینال + مغز»، بر هوش اجتماعی رباتها تمرکز کرده است. هدف این شرکت انتقال رباتها از محیطهای ساختاریافتهٔ انبارها…

انویدیا نسخه ۶۴ گیگابایتی سیستم دسکتاپ DGX Spark را برای اجرای محلی مدلهای ۳۰ میلیارد پارامتری و عاملهای همیشهفعال معرفی کرد. این سختافزار هزینههای متغیر API را حذف کرده و…

زیرساختهای هوش مصنوعی برای حل مشکل تأخیر در سیستمهای رباتیک و بلادرنگ، از مراکز دادهٔ دوردست به «لایههای شهری» منتقل میشوند. برآورد شرکت Teravolt نشان میدهد این تغییر مسیر…

استارتاپ Hestus برای ساخت مدلی از «هوش مکانیکی» ۷.۴ میلیون دلار سرمایه جذب کرد تا کارهای تکراری در نرمافزارهای CAD را حذف کند. هدف این شرکت عبور از تکمیل خودکار ساده و رسیدن به…

مایکروسافت برای کاهش اعتراضات محلی، از رویکرد «بیومیمیکری» یا تقلید از طبیعت برای استتار مراکز دادهٔ عظیم خود استفاده میکند. این اقدام در پاسخ به شکایت ساکنان از آلودگی صوتی و…

شرکت Cerebras با تفکیک مراحل پیشپُرکردن و رمزگشایی در سختافزارهای مجزا، توان عملیاتی استنتاج را ۵ برابر افزایش داد. این معماری ناهمگن اجازه میدهد هر مرحله بر اساس ماهیت…

گوگل نخستین ماهواره محاسباتی خود را برای آزمایش تراشههای TPU در محیط پرتاب کرد. تحلیلهای این شرکت نشان میدهد تحقق مراکز داده فضایی به کاهش شدید هزینههای پرتاب و افزایش چشمگیر…

پژوهشگران مستقل دریافتند که برخی میکروکنترلرهای ارزانقیمت ESP32 میتوانند پروتکلهای استاندارد وایفای و بلوتوث را دور بزنند و نمونههای خام رادیویی را ثبت کنند. این کشف امکان…

یک پروژه متنباز موفق شد شبکه رندرینگ عصبی DLSS 5 انویدیا را مهندسی معکوس کند و پیادهسازی Vulkan آن را با دقت بیت-به-بیت (Bit-Exact) بازسازی کند. این دستاورد اجازه میدهد فرآیند…

شرکتهای میکرون و سامسونگ هشدار دادند که تقاضای شدید برای حافظههای سرورهای هوش مصنوعی، عرضه رم برای لپتاپها و پیسیهای گیمینگ را تا سال ۲۰۲۸ محدود میکند.