پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۶۸۳ مقاله منتشر شده

معماری و مصالحه‌های بایز: ساخت عامل هوش مصنوعی سبک در Go
آموزش کاربردی

درون ساختار Baize؛ جایگزینی محیط‌های پیچیده با پردازش‌های جانبی

پلتفرم Baize با استفاده از زبان Go، محیط اجرای عامل‌های هوش مصنوعی را به یک پردازش جانبی (Sidecar) تبدیل کرده است. این رویکرد با حذف وابستگی‌های پیچیده پایتون، استقرار سریع و امن…

۷ دقیقه خواندن۳
لوگوی جیولایک: ربات چت‌بات هوش مصنوعی با آیکون موج صوتی و نام برند در زمینه تیره
آموزش کاربردی

«جایگزینی تولید کلمه با امتیازدهی»؛ راهکار Jevlike برای کاهش تأخیر

مدل متن‌باز Jevlike با جایگزینی تولید کلمه-به-کلمه با مکانیزم امتیازدهی تک‌مرحله‌ای، سرعت استنتاج را در وظایف انتخابی ۱۰۰ برابر افزایش داده است. این رویکرد نیاز به مدل‌های مولد…

۵ دقیقه خواندن
متا پس از انتقاد از فروش «عینک‌های ویژه»، نسخه بدون دوربین عرضه می‌کند

مدل Luna در برابر نسل‌های قبلی؛ اولویت حریم خصوصی بر تصویربرداری

متا برای مقابله با انتقادات مربوط به حریم خصوصی، در حال توسعه عینک هوشمند Luna است که هیچ دوربینی ندارد. این دستگاه به‌جای ثبت تصویر، بر تعاملات صوتی با هوش مصنوعی تمرکز می‌کند.

۲ دقیقه خواندن۱
اجایل ۱۵۰ میلیارد پارامتر MoE روی لپ‌تاپ توسعه‌دهنده: حداکثر سودمندی ذخیره‌سازی سریع‌تر
آموزش کاربردی

Colibrì: اجرای مدل ۱۵۰ میلیاردی روی لپ‌تاپ با ۶٪ گلوگاه ذخیره‌سازی

موتور استنتاج جدید Colibrì با استریم کردن خبره‌ها از حافظه SSD، اجرای مدل‌های عظیم ۱۵۰ میلیاردی را روی لپ‌تاپ‌های معمولی ممکن کرد. یافته‌ها نشان می‌دهد گلوگاه اصلی عملکرد، نه سرعت…

۱۶ دقیقه خواندن۴
لوگوی CetinLM با عنوان «شکستن افسانه زیرساخت میلیارد دلاری هوش مصنوعی»
آموزش کاربردی

پژوهش CetinLM: آموزش ۲ میلیارد توکن با یک پردازنده ۱۶ گیگابایتی

پژوهش جدید CetinLM ثابت کرد که پیش‌آموزش مدل‌های بنیادی لزوماً نیازمند خوشه‌های میلیاردی نیست. این تیم با بهینه‌سازی‌های سطح پایین، موفق شد بیش از ۲ میلیارد توکن را تنها با یک…

۴ دقیقه خواندن۲
احتمال بازگشت اپل به تولید سرور برای بهره‌مندی از موج هوش مصنوعی
اخبار کوتاه روزانهگزارش تأییدنشده

اپل با فناوری انویدیا به بازار سرورهای هوش مصنوعی بازمی‌گردد

اپل قصد دارد تا سال ۲۰۲۹ با ترکیب تراشه‌های سری M و فناوری اتصال انویدیا، دوباره وارد بازار سرور شود. این استراتژی برای تأمین نیازهای عظیم محاسباتی عصر هوش مصنوعی طراحی شده است.

۲ دقیقه خواندن۲
مراقبت‌های بهداشتی حاکمیت داده: امنیت ضروری مدل‌های زبانی بزرگ
آموزش کاربردی

زیرساخت‌های درون‌سازمانی در برابر ابر؛ نبردی برای امنیت اطلاعات بیماران

سازمان‌های بهداشتی برای جلوگیری از نشت اطلاعات حساس بیماران به زیرساخت‌های ابری، به سمت استقرار مدل‌های زبانی درون‌سازمانی حرکت می‌کنند. این رویکرد با کنترل کامل مسیر داده، امکان…

۴ دقیقه خواندن