پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۶۶۷ مقاله منتشر شده

هوش مصنوعی چندوجهی برای توسعه‌دهندگان: یکپارچه‌سازی متن، تصویر و صدا
آموزش کاربردی

تلفیق متن، تصویر و صدا در مدل‌های چندوجهی؛ تغییری در استراتژی توسعه‌دهندگان

هوش مصنوعی در حال گذار از پردازش تک‌بعدی به مدل‌های unified است که هم‌زمان متن، تصویر و صدا را تحلیل می‌کنند. این ادغام امکان درک عمیق‌تر بستر و استدلال‌های انسانی‌تر را در…

۲ دقیقه خواندن
دستیار صوتی هوشمند: تایپ در هر جا با صدا و ویرایش بدون چت‌بات
آموزش کاربردی

Lisup AI ویرایش متنی با فرمان صوتی را به تمام اپلیکیشن‌های دسکتاپ آورد

ابزار Lisup AI نیاز به کپی-پیست بین برنامه‌ها و مرورگر را حذف کرده و امکان تایپ و بازنویسی صوتی را مستقیماً در مکان‌نما (Cursor) سیستم‌عامل قرار می‌دهد. کاربران اکنون می‌توانند در…

۲ دقیقه خواندن۱
هوش مصنوعی مولد: فاجعه‌ای مهندسی

بحران جهانی حافظه؛ پیامد مستقیم مقیاس‌دهی «به‌زور» در هوش مصنوعی

مقیاس‌دهی ناکارآمد مدل‌های هوش مصنوعی زاینده باعث جهش قیمت حافظه و سخت‌افزار در سطح جهان شده است. کارشناسان هشدار می‌دهند که تقاضای شدید منابع ممکن است تا سال ۲۰۲۸ رایانه‌های…

۸ دقیقه خواندن۱
رتبه اول NVIDIA Nemotron 3 Embed در بنچمارک RTEB برای بازیابی عامل‌محور
آموزش کاربردی

Nemotron 3 Embed چگونه دقت گردش‌کارهای عامل‌محور را افزایش می‌دهد؟

انویدیا مجموعه‌ای از مدل‌های بردار معنایی با وزن‌های باز را برای کاهش هزینه‌های توکن و افزایش دقت در گردش‌کارهای عامل‌محور منتشر کرد. مدل پرچم‌دار ۸ میلیاردی این مجموعه در حال…

۹ دقیقه خواندن
گوگل ملزم به باز کردن اندروید و جستجو برای رقبا در اروپا شد

کمیسیون اروپا: داده‌های اندروید و جست‌وجوی گوگل باید برای رقبا باز شود

کمیسیون اروپا گوگل را مجبور کرد تا دسترسی رقبای هوش مصنوعی به ویژگی‌های سیستمی اندروید و داده‌های موتور جست‌وجو را فراهم کند. عدم اجرای این دستور می‌تواند گوگل را با جریمه‌هایی تا…

۳ دقیقه خواندن
وان‌پلاس رسماً از بازار آمریکا و اروپا خارج می‌شود

گزارش وان‌پلاس: توقف فروش مدل‌های جدید در غرب جهت یکپارچگی با اوپو

شرکت وان‌پلاس عرضه مدل‌های جدید خود در آمریکای شمالی و اروپا را متوقف کرد تا تمرکز استراتژیک خود را بر برند مادر یعنی اوپو معطوف کند. کاربران فعلی همچنان پشتیبانی دریافت می‌کنند،…

۲ دقیقه خواندن
شتاب‌دهی استنتاج مدل پایه رتبه پایین بلوکی بر پردازنده‌های گرافیکی محدود حافظه

کرنل‌های Triton سرعت استنتاج مدل‌های کم‌رتبه را ۳.۷۶ برابر کرد

پژوهشگران با طراحی کرنل‌های سفارشی Triton، گلوگاه‌های حافظه‌ای در فشرده‌سازی مدل‌های Block Low-Rank را برطرف کردند. این بهینه‌سازی‌ها سرعت استنتاج را در سخت‌افزارهای محدود مانند…

۳۶ دقیقه خواندن