پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۰۹۱ مقاله منتشر شده

چرا معماری ترکیبی CPU-GPU نیاز به کوانتیزه کردن مدل‌های MoE را از بین می‌برد؟

چرا معماری ترکیبی CPU-GPU نیاز به کوانتیزه کردن مدل‌های MoE را از بین می‌برد؟

پژوهشگران با طراحی یک معماری ترکیبی، اجرای مدل‌های Mixture-of-Experts (MoE) با دقت اصلی را روی سخت‌افزارهای مصرف‌کننده و با عملکردی در سطح مراکز داده ممکن کرده‌اند. این سیستم با…

۲ دقیقه خواندن
چرا زبان دیگر معیار اصلی درک قصد کاربر توسط ربات‌ها نیست؟

چرا زبان دیگر معیار اصلی درک قصد کاربر توسط ربات‌ها نیست؟

پژوهشگران چارچوب EDITH را معرفی کردند که با تلفیق نگاه کاربر، نمای اول‌شخص و گفتار، تعامل انسان و ربات را بهینه‌تر می‌کند. این سیستم با تبدیل سیگنال‌های نویزی به زیر-وظایف، نیاز…

۲ دقیقه خواندن
چرا مدل‌های زبانی باز ارزیابی‌های تنظیم MIMO را ۶ برابر کاهش می‌دهند؟

چرا مدل‌های زبانی باز ارزیابی‌های تنظیم MIMO را ۶ برابر کاهش می‌دهند؟

مدل‌های زبانی باز (Open LLMs) می‌توانند با پیشنهاد پیش‌فرض‌های ساختاری غیرمنتظره، تعداد تکرارهای مورد نیاز برای تنظیم کنترل‌کننده‌های صنعتی پیچیده را تا ۶ برابر کاهش دهند. این…

۲ دقیقه خواندن
چرا حفاظ‌های احتمالی عامل‌های هوش مصنوعی خودمختار شکست می‌خورند و چگونه راه‌حل قطعی ساختیم
آموزش کاربردی

Aegis-Layer: سد ریاضی برای توقف نشت داده‌های عامل‌های هوش مصنوعی در ۲ میلی‌ثانیه

پروژه‌ی متن‌باز Aegis-Layer امنیت عامل‌های هوش مصنوعی را از تکیه بر پرامپت‌های احتمالی به اعتبارسنجی ریاضی تغییر داد. این ابزار با استفاده از توکن‌های رمزنگاری‌شده، جلوی نشت…

۴ دقیقه خواندن
همگام‌سازی بومی دایرکتوری Home در کانتینرهای اپل؛ خداحافظی با محدودیت‌های Docker
آموزش کاربردی

همگام‌سازی بومی دایرکتوری Home در کانتینرهای اپل؛ خداحافظی با محدودیت‌های Docker

اپل راهکاری برای اجرای کانتینرهای لینوکس مبتنی بر OCI به عنوان ماشین‌های یکپارچه در macOS ارائه کرده است. این محیط‌ها به‌طور خودکار پوشه Home و نام کاربری میزبان را آینه می‌کنند…

۴ دقیقه خواندن
ای.ال.ال.ا — عامل منطق محلی توکار
آموزش کاربردی

جایگزینی «اعتماد» با «معماری»: استراتژی E.L.L.A برای توقف نشت داده‌ها

پروژه E.L.L.A با حذف فیزیکی مسیرهای ارسال داده به ابر، نشت اطلاعات را از طریق محدودیت‌های معماری غیرممکن می‌کند. این دستیار محلی ویندوز، امنیت را به جای تکیه بر قوانین اخلاقی، بر…

۴ دقیقه خواندن
آیا شرکت‌های فناوری می‌توانند عاشق مدل‌های ارزان‌تر هوش مصنوعی شوند؟

برایان آرمسترانگ: ۸۰٪ از حجم عملیات هوش مصنوعی به مدل‌های ارزان منتقل می‌شوند

صنعت هوش مصنوعی از رویکرد «هرچه بزرگ‌تر، بهتر» به سمت بهره‌وری هزینه‌ای حرکت می‌کند. پیش‌بینی می‌شود ظرف ۱۸ ماه آینده، اکثریت وظایف پردازشی به مدل‌های کوچک‌تر و ارزان‌تر منتقل…

۴ دقیقه خواندن
معماری شبکه KAN روی FPGA برای یادگیری ماشین فوق‌سریع

آروش گوپتا: افزایش ۲۷۰۰ برابری سرعت KANها در FPGA از طریق نگاشت LUT

پژوهشگر آروش گوپتا روشی را برای نگاشت مستقیم شبکه‌های کولموگروف-آرنولد (KANs) بر روی جداول جستجوی FPGA معرفی کرد. این رویکرد استنتاج در حد زیر-میکروثانیه و یادگیری آنی روی تراشه…

۱۱ دقیقه خواندن
مرکز داده اسپیس‌ایکس در مدار زمین

شرط ۲۰۰ دلاری اسپیس‌ایکس برای تبدیل مدار زمین به مرکز داده هوش مصنوعی

اسپیس‌ایکس قصد دارد تا اواخر سال ۲۰۲۷ مراکز داده هوش مصنوعی را در مدار زمین مستقر کند تا محدودیت‌های زمینی انرژی و زمین را دور بزند. با این حال، تحلیلگران هشدار می‌دهند که غلبه بر…

۲ دقیقه خواندن