پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۶۸۰ مقاله منتشر شده

مرد ثروتمند هند می‌خواهد رایانه‌های قدیمی را با هوش مصنوعی مجهز کند | تک‌کرانچ

«دسترسی همگانی»؛ استراتژی Jio برای ارتقای سخت‌افزارهای فرسوده هند

شرکت Reliance Jio دسترسی به سرویس رایانه‌های ابری خود را برای تمام کاربران اینترنت هند باز کرد. این اقدام به کاربران اجازه می‌دهد با پرداخت اشتراک، اپلیکیشن‌های مدرن هوش مصنوعی را…

۳ دقیقه خواندن۵
موتور استنتاج LLM پرسرعت در مرورگر
آموزش کاربردی

WebGPU چگونه اجرای مدل‌های زبانی بزرگ را به مرورگر منتقل کرد؟

پروژه WebLLM با بهره‌گیری از استاندارد WebGPU، امکان اجرای کامل مدل‌های زبانی بزرگ را بدون نیاز به سرور و مستقیماً در مرورگر فراهم می‌کند. این رویکرد با حذف پردازش‌های ابری، حریم…

۱۳ دقیقه خواندن۱
کوانتایزاسیون مدل: کاهش دقت برای افزایش سرعت و کاهش هزینه هوش مصنوعی
آموزش کاربردی

کوانتایزیشن: کاهش هزینه استنتاج بدون حذف پارامترهای مدل

کوانتایزیشن با کاهش دقت عددی وزن‌ها و فعال‌سازها، مصرف حافظه و انرژی را به‌شدت کم می‌کند. برخلاف هرس کردن، این روش ساختار مدل را حفظ کرده و سرعت استنتاج را روی سخت‌افزارهای لبه…

۱۱ دقیقه خواندن۱
کامپیوتر دسکتاپ کوچک ایسر با قابلیت هوش مصنوعی محلی

آیا دسکتاپ‌های فوق‌فشرده می‌توانند جایگزین ابرسرویس‌های هوش مصنوعی شوند؟

شرکت ایسر دسکتاپ فوق‌فشرده‌ای را معرفی کرد که با تکیه بر تراشه RTX Spark انویدیا، اجرای عامل‌های هوش مصنوعی پیچیده را به‌صورت محلی ممکن می‌کند. این سیستم با ترکیب پردازنده و…

۴ دقیقه خواندن۱
مهندسی هوش مصنوعی برای توسعه‌دهندگان فلاتر — پیاده‌سازی تولیدی هوش مصنوعی در فلاتر
آموزش کاربردی

۵ ستون معماری برای تبدیل دموهای هوش مصنوعی به اپلیکیشن‌های تجاری در Flutter

انتقال قابلیت‌های هوش مصنوعی از محیط دمو به محصول نهایی نیازمند تغییر رویکرد در زمینه عملکرد، حریم خصوصی و امنیت است. این راهنما الزامات معماری برای عرضه نسخه‌های پایدار و…

۳ دقیقه خواندن
بهترین ابزارهای رایگان تولید تصویر با هوش مصنوعی که روی سخت‌افزار خودتان اجرا می‌شوند
آموزش کاربردی

۴ ابزار رایگان برای اجرای محلی مدل‌های تولید تصویر و حذف هزینه‌های API

اجرای محلی مدل‌های تولید تصویر، ریسک‌های حریم خصوصی و هزینه‌های تکراری APIهای ابری را حذف می‌کند. ابزارهایی مانند ComfyUI و Draw Things اکنون امکان اجرای مدل‌های پیشرفته‌ای مثل…

۶ دقیقه خواندن۲
سلامت داده‌محور: کنترل ضروری مدل زبانی بزرگ
آموزش کاربردی

استقرار درون‌سازمانی مدل‌های زبانی؛ راهکار مقابله با نشت داده‌های پزشکی

سازمان‌های بهداشتی برای حفظ حاکمیت داده‌های حساس بیماران، از استنتاج محلی هوش مصنوعی استفاده می‌کنند. این رویکرد اجازه می‌دهد جریان‌های کاری بالینی بدون ریسک انتقال داده به…

۴ دقیقه خواندن۳
راهنمای هزینه‌های کل مالکیت Llama برای مدل‌های زبانی خودمیزبان
آموزش کاربردی

زیرساخت شخصی در برابر API؛ نقطه سربه‌سر در ۳ میلیارد توکن

تحلیل جدید هزینه کل مالکیت نشان می‌دهد که جایگزینی APIها با زیرساخت شخصی برای حجم‌های بالا، حدود یک سال زمان می‌برد تا هزینه سرمایه‌گذاری اولیه را جبران کند. این سودآوری به شدت به…

۴ دقیقه خواندن
تنظیم مدل محلی روی مک مینی M4 Pro
آموزش کاربردی

مک‌مینی M4 Pro با مدل‌های MoE حاکمیت محلی بر هوش مصنوعی را ممکن کرد

یک پیاده‌سازی عملی نشان می‌دهد که مک‌مینی M4 Pro با ۴۸ گیگابایت رم می‌تواند مدل‌های زبانی بزرگ با معماری ترکیب خبره‌ها را به‌صورت محلی اجرا کند. این ساختار هزینه‌های API را حذف…

۷ دقیقه خواندن۲