پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۷۶۹ مقاله منتشر شده

فراخوانی API مدل زبانی به معنای درک نحوه کار آن نیست
آموزش کاربردی

مصرف API در برابر تسلط بر ترنسفورمرها در مهندسی مدل‌های زبانی

بسیاری از توسعه‌دهندگان اتصال به API را با تخصص در هوش مصنوعی اشتباه می‌گیرند. یک راهنمای جامع جدید تأکید می‌کند که برای مهندسی واقعی، تسلط بر ترنسفورمرها و توکن‌سازی ضروری است.

۲ دقیقه خواندن۱
سیستم‌های صورتحساب اعتباری و محاسباتی مقاوم برای گردش کارهای سنگین GPU
آموزش کاربردی

واحد‌های محاسباتی دانه‌ریز؛ راهکار جدید برای پایان هزینه‌های پیش‌بینی‌ناپذیر GPU

یک چارچوب معماری جدید، صورت‌حساب‌های سادهٔ مبتنی بر زمان را با «واحدهای محاسباتی دانه‌ریز» (GCU) جایگزین می‌کند تا قیمت‌گذاری دقیق‌تری برای جریان‌های کاری سنگین هوش مصنوعی ارائه…

۱۳ دقیقه خواندن
اجرای محلی Qwen3.8 27B روی مک استودیو: اعداد واقعی و بنچمارک‌های عملکردی
آموزش کاربردی

مدل Qwen3.8 27B سرعت استنتاج را نصف کرد اما پاسخ‌ها را سریع‌تر به پایان می‌رساند

بنچمارک‌های مدل Qwen3.8 27B روی مک استودیو نشان می‌دهد که با وجود کاهش سرعت تولید توکن، به‌دلیل ایجاز بیشتر در پاسخ‌ها، زمان کل انتظار کاربر کاهش یافته است. این مدل امکان…

۹ دقیقه خواندن۵
تقریباً همه توهمات GLM 5.3 Flash ۲ بیتی را با SIMURG از بین بردم
آموزش کاربردیگزارش تأییدنشده

SIMURG توهمات مدل‌های کوانتیده را با بازخورد لحظه‌ای حذف می‌کند

ابزار جدیدی به نام SIMURG اجازه می‌دهد توهمات مدل‌های زبانی را در لحظه و با بازخوردهای ساده اصلاح کنید. این سیستم توانست خطاهای مدل GLM 5.3 Flash را بدون نیاز به آموزش مجدد و…

۲ دقیقه خواندن۴
اعداد هوش مصنوعی پنهان در سایه چه چیزی را پنهان می‌کنند؟
زندگی با AI

گزارش فضای دیجیتال: رشد ۱۰۰۰ درصدی دستیارهای هوش مصنوعی در ۲۰۲۵

گسترش گسترده و غیررسمی ابزارهای هوش مصنوعی در سازمان‌ها، شکاف‌های امنیتی عمیقی را در مدیریت دستگاه‌های سازمانی آشکار کرده است. داده‌ها نشان می‌دهند سازمان‌هایی با نرخ بالای «هوش…

۸ دقیقه خواندن۱
راهنمای جامع استفاده از مدل‌های زبانی بزرگ در محاسبات مه‌ای
آموزش کاربردی

گره‌های مه؛ راهکاری برای کاهش هزینه‌های استنتاج مدل‌های زبانی بزرگ

استقرار مدل‌های زبانی بزرگ در محیط‌های توزیع‌شده نیازمند معماری سه‌لایه برای تعادل میان محدودیت سخت‌افزاری و هزینه‌های ابری است. استفاده از گره‌های مه به‌عنوان دروازه‌های هوشمند،…

۱ دقیقه خواندن۲