پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۷۷۱ مقاله منتشر شده

استنتاج تا ۳.۲ برابر سریع‌تر با LFM2.5-DSpark
آموزش کاربردی

چطور DSpark سرعت پاسخ‌دهی عامل‌های هوشمند را در سخت‌افزارهای محلی بالا برد؟

شرکت Liquid AI با معرفی مدل‌های پیش‌نویس DSpark و استفاده از رمزگشایی گمانه‌زنانه، توان عملیاتی مدل‌های LFM2.5 را روی GPU و مک‌بوک به‌شدت افزایش داد. این به‌روزرسانی تأخیر…

۵ دقیقه خواندن۱
دو کارت گرافیک در حال پردازش هوش مصنوعی در یک کیس کامپیوتر خانگی
آموزش کاربردی

رمزگشایی گمانه‌زنانه سرعت استنتاج مدل‌های محلی روی سخت‌افزارهای قدیمی را

یک آزمایش عملی نشان می‌دهد ترکیب رمزگشایی گمانه‌زنانه با بهینه‌سازی‌های سطح BIOS و کرنل می‌تواند سرعت تولید توکن را در سرورهای خانگی چند-GPU دوبرابر کند. این روش با رفع گلوگاه‌های…

۲۶ دقیقه خواندن۱
حاکمیت MCP توضیح داده شد: چیست و چگونه کار می‌کند
آموزش کاربردی

Bifrost با لایه‌ی حاکمیتی، حفره‌های امنیتی عامل‌های MCP را می‌بندد

پروتکل MCP ادغام ابزارها در هوش مصنوعی را ساده می‌کند اما ریسک‌های امنیتی شدیدی در محیط‌های سازمانی ایجاد می‌کند. Bifrost با ایجاد یک درگاه حاکمیتی، دسترسی به ابزارها را فیلتر…

۸ دقیقه خواندن۳
نشت اطلاعات خانه هوشمند اپل - همه آنچه در سپتامبر انتظار داریم
اخبار کوتاه روزانهگزارش تأییدنشده

نشت اطلاعات MacOS: ۱۰ سخت‌افزار جدید اپل از جمله آیفون تاشو فاش شد

یک نشت نرم‌افزاری در نسخه MacOS Tahoe 26.7، شناسه‌های داخلی ۱۰ دستگاه منتشرنشده اپل را افشا کرد. این لیست شامل یک نمایشگر خانه هوشمند و مدل تاشوی آیفون ۱۸ است که نشان‌دهنده…

۵ دقیقه خواندن۳
ابزار تبدیل صدا به متن Wispr Flow از قابلیت داخلی دستگاه شما بهتر است - رایگان امتحان کنید
آموزش کاربردی

Wispr Flow در برابر ابزارهای پیش‌فرض سیستم‌عامل؛ برتری در فرمت‌بندی خودکار

ابزار Wispr Flow با بهره‌گیری از هوش مصنوعی، جایگزینی دقیق‌تر و منعطف‌تر برای سیستم‌های تبدیل گفتار به متن در ویندوز و مک ارائه داده است. این ابزار با قابلیت‌هایی نظیر Vibe Coding…

۸ دقیقه خواندن۱
ابزار پاک‌سازی توکن‌های اضافی کلود ۵ با مدل زبانی دیگر. صرفه‌جویی در توکن، کلود ۵ ناامیدکننده است.
آموزش کاربردی

ابزار Vomit خروجی‌های نامفهوم Claude 5 را با مدل‌های محلی پاک‌سازی می‌کند

ابزار متن‌باز Vomit با انتقال خروجی‌های به‌هم‌ریخته مدل Claude 5 به یک مدل زبانی محلی، آن‌ها را به متنی خوانا تبدیل می‌کند. این ابزار راهکاری کاملاً محلی و بدون نیاز به ارسال داده…

۱ دقیقه خواندن۲
هوش مصنوعی جدید با تحلیل گفتگوهای گذشته، پاسخ بعدی شما را پیش‌بینی می‌کند

سیستم پیش‌بینی رفتار کلامی MIT بر اساس تحلیل داده‌های بلندمدت

پژوهشگران MIT با توسعه یک خط لوله مبتنی بر مدل‌های زبانی بزرگ، توانستند با تحلیل هفته‌ها مکالمات واقعی از طریق ساعت‌های هوشمند، پاسخ‌های احتمالی بعدی کاربران را پیش‌بینی کنند. این…

۸ دقیقه خواندن۲
هک ساعت هوشمند ۲۷ دلاری با کلود
آموزش کاربردی

«جریان‌های کاری عامل‌محور»؛ راهکاری برای ساخت سریع رابط‌های سخت‌افزاری

مایک کاسبرگ با استفاده از Claude و مدل‌های متن‌باز، یک صفحه ساعت سفارشی برای سخت‌افزار ارزان‌قیمت PineTime ساخت. این پروژه نشان می‌دهد چگونه جریان‌های کاری عامل‌محور می‌توانند…

۴ دقیقه خواندن
مدل همیشه بخش کند استنتاج محلی نیست
آموزش کاربردی

اولاما با حافظهٔ متاداده تأخیر استنتاج محلی را کاهش داد

نسخه پیش‌انتشار ۰.۳۲.۱۵ اولاما با معرفی حافظهٔ متاداده، سربار هر درخواست را حذف می‌کند. این به‌روزرسانی نشان می‌دهد که سرعت نهایی تجربه کاربر، فراتر از نرخ تولید توکن و وابسته به…

۲ دقیقه خواندن۲
اگر این درست باشد، ابرشرکت‌های فناوری نابود شده‌اند.

مطالعه استنفورد: مدل‌های زبانی کوچک در ۸۱٪ وظایف با مدل‌های ابری برابری می‌کنند

پژوهش جدید دانشگاه استنفورد نشان می‌دهد مدل‌های زبانی کوچک (SLM) که روی سخت‌افزار محلی اجرا می‌شوند، به‌سرعت در حال پر کردن شکاف عملکرد با مدل‌های ابری هستند. این تغییر می‌تواند…

۵ دقیقه خواندن۲