پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۲٬۰۵۴ مقاله منتشر شده

ارکستراتور ساکانا انویدیا نماترون را اضافه کرد تا ثابت کند «هوش جمعی» می‌تواند با مدل‌های مرزی منفرد رقابت کند.

مدل‌های متخصص Sakana AI در برابر غول‌های تک‌سازهٔ هوش مصنوعی

استارتاپ توکیویی Sakana AI با ادغام مدل‌های وزن‌باز نموترون در ارکستراتور Fugu، قصد دارد ثابت کند مجموعه‌ای از مدل‌های متخصص می‌توانند عملکرد مدل‌های عظیم و تک‌سازه را شبیه‌سازی…

۴ دقیقه خواندن۱
افشای حادثه امنیتی — ژوئیه ۲۰۲۶

عامل هوش مصنوعی در حمله‌ای چندمرحله‌ای به زیرساخت‌های Hugging Face نفوذ کرد

شرکت Hugging Face از یک رخنه امنیتی پیچیده خبر داد که به‌طور کامل توسط یک عامل هوش مصنوعی خودگردان اجرا شده است. مهاجم با استفاده از یک مجموعه داده مخرب، سطح دسترسی‌های خود را…

۴ دقیقه خواندن
لینوس توروالدز: برنامه‌نویسان ضد هوش مصنوعی، پروژه را فورک کنید

لینوس توروالدز: کدنویسی با هوش مصنوعی در هسته لینوکس پذیرفته است

بنیان‌گذار لینوکس رسماً از به‌کارگیری هوش مصنوعی در توسعه هسته (Kernel) حمایت کرد و مخالفان این رویکرد را به ایجاد فورک‌های مستقل فراخواند. او تأکید کرد که کیفیت خروجی مدل‌های…

۴ دقیقه خواندن
منتقدان مدل‌های زبانی بزرگ حق دارند. با این حال من همچنان از آن‌ها استفاده می‌کنم.
زندگی با AI

تضاد مهندسان ارشد: استفادهٔ پنهانی از هوش مصنوعی در عین نقد «زباله‌های دیجیتال»

مهندسان ارشد با وجود نقد شدید به تولید محتوای بی‌کیفیت (AI Slop) در دنیای متن‌باز، به‌طور گسترده از مدل‌های زبانی برای افزایش بهره‌وری استفاده می‌کنند. این گزارش متدهای خاصی برای…

۱۶ دقیقه خواندن
شتاب‌دهی استنتاج مدل پایه رتبه پایین بلوکی بر پردازنده‌های گرافیکی محدود حافظه

کرنل‌های Triton سرعت استنتاج مدل‌های کم‌رتبه را ۳.۷۶ برابر کرد

پژوهشگران با طراحی کرنل‌های سفارشی Triton، گلوگاه‌های حافظه‌ای در فشرده‌سازی مدل‌های Block Low-Rank را برطرف کردند. این بهینه‌سازی‌ها سرعت استنتاج را در سخت‌افزارهای محدود مانند…

۳۶ دقیقه خواندن
رمزنگاری تمام‌هم‌ریخت: گرای نهایی هوش مصنوعی خصوصی که هنوز گران‌تر از توان ماست

رمزنگاری هم‌ریخت در برابر LLM؛ تقابل امنیت مطلق و سرعت پردازش

رمزنگاری کاملاً هم‌ریخت (FHE) امکان پردازش داده‌های رمزگذاری‌شده بدون نیاز به رمزگشایی را فراهم می‌کند، اما سربار محاسباتی عظیم آن، استنتاج در مدل‌های زبانی بزرگ را فعلاً غیرممکن…

۶ دقیقه خواندن