پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۷۶۷ مقاله منتشر شده

مدل ۴ میلیارد پارامتری Spark-X2.5-4B با عملکردی معادل مدل‌های ۲ تا ۳ برابر بزرگ‌تر در وظایف عامل، کد و ریاضی.

مدل Spark-X2.5-4B در کدنویسی و استدلال از رقبای ۱۲ میلیاردی پیشی گرفت

مدل باز Spark-X2.5-4B با وجود اندازه کوچک، در وظایف عامل‌محور، ریاضیات و کدنویسی عملکردی مشابه مدل‌هایی با اندازه سه برابر خود نشان داد. این مدل در چندین محک کلیدی، رقبایی چون…

۱ دقیقه خواندن
ریاضیدانان روس به مدل‌های هوش مصنوعی آموختند بدون کلام با هم گفتگو کنند

تبادل وزن‌ها در برابر تبادل متن؛ روشی ارزان‌تر برای اتصال مدل‌های AI

استارتاپ Mostik روشی را ابداع کرده که مدل‌های هوش مصنوعی به‌جای تبادل متن، از طریق مقادیر ریاضی وزن‌ها با یکدیگر ارتباط برقرار کنند. این تکنیک به مدل‌های کوچک اجازه می‌دهد هوشمندی…

۴ دقیقه خواندن۳
مرد ثروتمند هند می‌خواهد رایانه‌های قدیمی را با هوش مصنوعی مجهز کند | تک‌کرانچ

«دسترسی همگانی»؛ استراتژی Jio برای ارتقای سخت‌افزارهای فرسوده هند

شرکت Reliance Jio دسترسی به سرویس رایانه‌های ابری خود را برای تمام کاربران اینترنت هند باز کرد. این اقدام به کاربران اجازه می‌دهد با پرداخت اشتراک، اپلیکیشن‌های مدرن هوش مصنوعی را…

۳ دقیقه خواندن۵
موتور استنتاج LLM پرسرعت در مرورگر
آموزش کاربردی

WebGPU چگونه اجرای مدل‌های زبانی بزرگ را به مرورگر منتقل کرد؟

پروژه WebLLM با بهره‌گیری از استاندارد WebGPU، امکان اجرای کامل مدل‌های زبانی بزرگ را بدون نیاز به سرور و مستقیماً در مرورگر فراهم می‌کند. این رویکرد با حذف پردازش‌های ابری، حریم…

۱۳ دقیقه خواندن۲
کوانتایزاسیون مدل: کاهش دقت برای افزایش سرعت و کاهش هزینه هوش مصنوعی
آموزش کاربردی

کوانتایزیشن: کاهش هزینه استنتاج بدون حذف پارامترهای مدل

کوانتایزیشن با کاهش دقت عددی وزن‌ها و فعال‌سازها، مصرف حافظه و انرژی را به‌شدت کم می‌کند. برخلاف هرس کردن، این روش ساختار مدل را حفظ کرده و سرعت استنتاج را روی سخت‌افزارهای لبه…

۱۱ دقیقه خواندن۱
کامپیوتر دسکتاپ کوچک ایسر با قابلیت هوش مصنوعی محلی

آیا دسکتاپ‌های فوق‌فشرده می‌توانند جایگزین ابرسرویس‌های هوش مصنوعی شوند؟

شرکت ایسر دسکتاپ فوق‌فشرده‌ای را معرفی کرد که با تکیه بر تراشه RTX Spark انویدیا، اجرای عامل‌های هوش مصنوعی پیچیده را به‌صورت محلی ممکن می‌کند. این سیستم با ترکیب پردازنده و…

۴ دقیقه خواندن۲
مهندسی هوش مصنوعی برای توسعه‌دهندگان فلاتر — پیاده‌سازی تولیدی هوش مصنوعی در فلاتر
آموزش کاربردی

۵ ستون معماری برای تبدیل دموهای هوش مصنوعی به اپلیکیشن‌های تجاری در Flutter

انتقال قابلیت‌های هوش مصنوعی از محیط دمو به محصول نهایی نیازمند تغییر رویکرد در زمینه عملکرد، حریم خصوصی و امنیت است. این راهنما الزامات معماری برای عرضه نسخه‌های پایدار و…

۳ دقیقه خواندن
بهترین ابزارهای رایگان تولید تصویر با هوش مصنوعی که روی سخت‌افزار خودتان اجرا می‌شوند
آموزش کاربردی

۴ ابزار رایگان برای اجرای محلی مدل‌های تولید تصویر و حذف هزینه‌های API

اجرای محلی مدل‌های تولید تصویر، ریسک‌های حریم خصوصی و هزینه‌های تکراری APIهای ابری را حذف می‌کند. ابزارهایی مانند ComfyUI و Draw Things اکنون امکان اجرای مدل‌های پیشرفته‌ای مثل…

۶ دقیقه خواندن۲
سلامت داده‌محور: کنترل ضروری مدل زبانی بزرگ
آموزش کاربردی

استقرار درون‌سازمانی مدل‌های زبانی؛ راهکار مقابله با نشت داده‌های پزشکی

سازمان‌های بهداشتی برای حفظ حاکمیت داده‌های حساس بیماران، از استنتاج محلی هوش مصنوعی استفاده می‌کنند. این رویکرد اجازه می‌دهد جریان‌های کاری بالینی بدون ریسک انتقال داده به…

۴ دقیقه خواندن۴