
نمودار توانمندی انویدیا: مدل Nemotron 3.5 با پنجره متنی یک میلیون توکنی
انویدیا مدل Nemotron-3.5-Lightning-30B را برای بهینهسازی عاملهای خودکار و استنتاج محلی عرضه کرد. این مدل با ترکیب معماری MoE و Mamba، پنجره متنی عظیم یک میلیون توکنی را روی…
موضوع
SLMs, on-device inference, mobile AI, AI PCs
۱٬۷۷۳ مقاله منتشر شده

انویدیا مدل Nemotron-3.5-Lightning-30B را برای بهینهسازی عاملهای خودکار و استنتاج محلی عرضه کرد. این مدل با ترکیب معماری MoE و Mamba، پنجره متنی عظیم یک میلیون توکنی را روی…

سامانه Pulse با ترکیب مدل Qwen3.5 و پایگاهداده Qdrant، جستوجوی مبتنی بر قصد کاربر را جایگزین تطبیق دقیق کلمات کرد. این سیستم بهصورت کاملاً محلی اجرا میشود تا حاکمیت دادهها…

یک حفره امنیتی جدید نشان میدهد بدافزارهای ویندوزی میتوانند تمام پسکلیدهای ذخیرهشده در مدیریت رمز عبور گوگل را استخراج کنند. این آسیبپذیری ناشی از مدل دسترسی باز در ویندوز در…

دیستیل کردن مدلهای انتشار برخلاف مدلهای متنی، به جای تقلید از یک پاسخ نهایی، بر فشردهسازی کل مسیر تبدیل نویز به تصویر تمرکز دارد. این تغییر رویکرد، آموزش هوش مصنوعی را از تقلید…

یک معماری جدید با بهرهگیری از Fastify، کشینگ Redis و سیستم ویجتهای پویا در Flutter، تأخیر در نمایش رابطهای کاربری زاینده را به زیر ۲۰۰ میلیثانیه کاهش داده است. این رویکرد…

دیوید گارسیا مونیوز-هیتا استدلال میکند که وعده «شخصیسازی افراطی» در آموزش، بیشتر یک تبلیغات توخالی است. او برای تضمین حریم خصوصی و ارزش آموزشی واقعی، استفاده از مدلهای محلی و…

موتور استنتاج بومی h3.c با بهینهسازی حافظه و کوانتش int8، اجرای محلی مدل MiniMax-H3 را روی تراشههای اپل ممکن کرد. این ابزار زمان حذف نویز (Denoising) برای کلیپهای کوتاه را از…

کلودفلر مرورگر تخصصی Kitesurf را برای عاملهای هوش مصنوعی معرفی کرد که با حذف قابلیتهای انسانی، بهرهوری منابع را به قیمت کاهش سرعت افزایش میدهد. این ابزار نشان میدهد که در…

گزارش جدید Itelnet Consulting نشان میدهد شکاف عمیقی میان وعدههای بازاریابی و کاربرد واقعی هوش مصنوعی وجود دارد. دلیل اصلی این ریزش، نبود بستر کسبوکار و هزینه زمانی بالای اصلاح…

گزارش جدید مؤسسه بروکینگز هشدار میدهد که سیاستهای محدودکننده علیه مدلهای وزنباز، نوآوری و امنیت ملی آمریکا را به خطر میاندازد. این تحلیل تأکید میکند که دسترسی به وزنهای مدل…

شرکت Cactus مدل Needle 2 را معرفی کرد؛ مدلی با ۴۵ میلیون پارامتر که برای فراخوانی ابزار در سختافزارهای ارزانقیمت طراحی شده است. این مدل با حجم تنها ۱۴ مگابایت، روی دستگاههایی…

متا مدل Muse Glimmer را با وزنهای باز منتشر کرد تا اجرای عاملهای هوش مصنوعی بهصورت محلی و خصوصی روی سختافزارهای مصرفکننده ممکن شود. این اقدام گامی عملی در مسیر تحقق چشمانداز…