پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۷۶۲ مقاله منتشر شده

آموزش کاربردی

چگونه مدل Gemma 4 گوگل با کمتر از ۱ گیگابایت حافظه روی موبایل اجرا می‌شود؟

گوگل با معرفی نقاط بازبینی جدید مبتنی بر آموزش آگاه از کوانتایزیشن (QAT)، مدل Gemma 4 E2B را به زیر ۱ گیگابایت حافظه رساند. این به‌روزرسانی امکان اجرای مدل‌های زبانی باکیفیت را…

۳ دقیقه خواندن۸
چرا ابزاری که یک‌سوم دنیای هوش مصنوعی را می‌چرخاند، سازنده‌اش را نجات نمی‌دهد؟

چرا ابزاری که یک‌سوم دنیای هوش مصنوعی را می‌چرخاند، سازنده‌اش را نجات نمی‌دهد؟

گزارش جدید Wiz نشان می‌دهد llamafile اکنون در ۳۳٪ از زیرساخت‌های ابری هوش مصنوعی حضور دارد و از ابزارهای رسمی بسیاری پیشی گرفته است. با این حال، سازنده‌ی این پروژه در وضعیتی…

۳ دقیقه خواندن۴
بازگشت به واقعیت؛ چرا Halide Mark III پردازش‌های هوش مصنوعی را کنار گذاشت؟

بازگشت به واقعیت؛ چرا Halide Mark III پردازش‌های هوش مصنوعی را کنار گذاشت؟

اپلیکیشن Halide Mark III با معرفی قابلیت Looks، رویکردی ضد-هوش مصنوعی را برای بازگشت به رنگ‌های طبیعی در عکاسی موبایل پیش گرفته است. این برنامه که با همکاری کالن کلی ساخته شده،…

۳ دقیقه خواندن۳
چطور گره‌های محلی هوش مصنوعی هزینه‌های ماهانه CRM را به صفر می‌رسانند؟
آموزش کاربردی

چطور گره‌های محلی هوش مصنوعی هزینه‌های ماهانه CRM را به صفر می‌رسانند؟

پلتفرم BizNode با انتقال مدیریت مشتریان و جذب لید از فضای ابری به سخت‌افزار محلی، مدل اشتراکی SaaS را با خرید یک‌باره جایگزین کرده است. این ابزار با استفاده از یک استک محلی، امنیت…

۲ دقیقه خواندن
چرا یک تراشه ۱۵۰ دلاری و متن‌باز تهدیدی برای انحصار انویدیا است؟

چرا یک تراشه ۱۵۰ دلاری و متن‌باز تهدیدی برای انحصار انویدیا است؟

پروژه‌ی TSU Protocol با هدف شکستن انحصار سخت‌افزاری انویدیا و اپل، در حال توسعه‌ی یک پردازنده عصبی متن‌باز بر پایه RISC-V است. این پروژه برای تولید اولین نمونه‌ی تراشه‌های خود، به…

۲ دقیقه خواندن
بهینه‌سازی انرژی با ۹۰٪ داده‌ی گم‌شده؛ قدرت شبکه‌های عصبی گراف احتمالی
آموزش کاربردی

بهینه‌سازی انرژی با ۹۰٪ داده‌ی گم‌شده؛ قدرت شبکه‌های عصبی گراف احتمالی

پیاده‌سازی جدیدی از شبکه‌های عصبی گراف احتمالی (PGNN) به ریزشبکه‌های هوشمند اجازه می‌دهد حتی با فقدان ۹۰ درصد داده‌های حسگرها، جریان انرژی را بهینه کنند. این سیستم با مدل‌سازی…

۲ دقیقه خواندن۱
استارت سرد ۲۰ میلی‌ثانیه‌ای در Garudust؛ استاندارد جدید اتوماسیون زبان تایلندی
آموزش کاربردی

استارت سرد ۲۰ میلی‌ثانیه‌ای در Garudust؛ استاندارد جدید اتوماسیون زبان تایلندی

ترکیب ابزار Rust-محور Garudust و مدل Typhoon، عامل‌های هوش مصنوعی تایلندی را با سرعت بیداری خیره‌کننده‌ای فعال می‌کند. این استک امکان اتوماسیون منطقه‌ای با تأخیر بسیار کم و بدون…

۲ دقیقه خواندن
چگونه استریم لحظه‌ای مدل‌های زبانی را با کمتر از ۱۵۰ خط کد در Next.js بسازیم؟
آموزش کاربردی

چگونه استریم لحظه‌ای مدل‌های زبانی را با کمتر از ۱۵۰ خط کد در Next.js بسازیم؟

پیاده‌سازی Server-Sent Events (SSE) در Next.js اجازه می‌دهد مدل‌های زبانی محلی در Ollama، توکن‌ها را کلمه به کلمه ارسال کنند. این روش تأخیر در نمایش متن را می‌گیرد و تجربه کاربری…

۲ دقیقه خواندن
پایان قرارداد ۴۰۰ میلیون دلاری اسنپ با Perplexity پیش از عرضه گسترده

پایان قرارداد ۴۰۰ میلیون دلاری اسنپ با Perplexity پیش از عرضه گسترده

اسنپ مشارکت ۴۰۰ میلیون دلاری خود با Perplexity AI را پیش از عرضه گسترده متوقف کرد. این شرکت اکنون تمرکز خود را بر عینک‌های هوشمند و مدیریت هزینه‌ها پس از تعدیل نیروهای گسترده…

۲ دقیقه خواندن