پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۹۵۰ مقاله منتشر شده

شتاب‌دهی استنتاج مدل پایه رتبه پایین بلوکی بر پردازنده‌های گرافیکی محدود حافظه

کرنل‌های Triton سرعت استنتاج مدل‌های کم‌رتبه را ۳.۷۶ برابر کرد

پژوهشگران با طراحی کرنل‌های سفارشی Triton، گلوگاه‌های حافظه‌ای در فشرده‌سازی مدل‌های Block Low-Rank را برطرف کردند. این بهینه‌سازی‌ها سرعت استنتاج را در سخت‌افزارهای محدود مانند…

۳۶ دقیقه خواندن
رمزنگاری تمام‌هم‌ریخت: گرای نهایی هوش مصنوعی خصوصی که هنوز گران‌تر از توان ماست

رمزنگاری هم‌ریخت در برابر LLM؛ تقابل امنیت مطلق و سرعت پردازش

رمزنگاری کاملاً هم‌ریخت (FHE) امکان پردازش داده‌های رمزگذاری‌شده بدون نیاز به رمزگشایی را فراهم می‌کند، اما سربار محاسباتی عظیم آن، استنتاج در مدل‌های زبانی بزرگ را فعلاً غیرممکن…

۶ دقیقه خواندن
کنترل چت و هوش مصنوعی: پرامپت‌های شما هم امن نیستند
زندگی با AI

پرامپت‌های هوش مصنوعی در برابر پیام‌های شخصی در پروتکل‌های امنیتی اروپا

مقامات اتحادیه اروپا در حال بررسی گسترش پروتکل‌های نظارتی Chat Control هستند تا تعاملات کاربران با چت‌بات‌ها را نظارت کنند. این اقدام باعث می‌شود پرامپت‌ها مانند پیام‌های شخصی…

۳ دقیقه خواندن۲
فضای J، مدل‌های متن‌باز — نسخه ۲

بردار‌های هدایت مفاهیم در مدل‌های مختلف هوش مصنوعی با چرخش خطی منتقل می‌شوند

پژوهش‌های جدید نشان می‌دهد بردار‌های هدایت (Steering Vectors) یک مدل زبانی را می‌توان با یک چرخش ریاضی ساده به مدل دیگری از خانواده‌ای متفاوت منتقل کرد. این یافته ثابت می‌کند…

۲۰ دقیقه خواندن