
چطور DSpark سرعت پاسخدهی عاملهای هوشمند را در سختافزارهای محلی بالا برد؟
شرکت Liquid AI با معرفی مدلهای پیشنویس DSpark و استفاده از رمزگشایی گمانهزنانه، توان عملیاتی مدلهای LFM2.5 را روی GPU و مکبوک بهشدت افزایش داد. این بهروزرسانی تأخیر…
موضوع
SLMs, on-device inference, mobile AI, AI PCs
۱٬۷۷۱ مقاله منتشر شده

شرکت Liquid AI با معرفی مدلهای پیشنویس DSpark و استفاده از رمزگشایی گمانهزنانه، توان عملیاتی مدلهای LFM2.5 را روی GPU و مکبوک بهشدت افزایش داد. این بهروزرسانی تأخیر…

یک آزمایش عملی نشان میدهد ترکیب رمزگشایی گمانهزنانه با بهینهسازیهای سطح BIOS و کرنل میتواند سرعت تولید توکن را در سرورهای خانگی چند-GPU دوبرابر کند. این روش با رفع گلوگاههای…

پروتکل MCP ادغام ابزارها در هوش مصنوعی را ساده میکند اما ریسکهای امنیتی شدیدی در محیطهای سازمانی ایجاد میکند. Bifrost با ایجاد یک درگاه حاکمیتی، دسترسی به ابزارها را فیلتر…

یک نشت نرمافزاری در نسخه MacOS Tahoe 26.7، شناسههای داخلی ۱۰ دستگاه منتشرنشده اپل را افشا کرد. این لیست شامل یک نمایشگر خانه هوشمند و مدل تاشوی آیفون ۱۸ است که نشاندهنده…

ابزار Wispr Flow با بهرهگیری از هوش مصنوعی، جایگزینی دقیقتر و منعطفتر برای سیستمهای تبدیل گفتار به متن در ویندوز و مک ارائه داده است. این ابزار با قابلیتهایی نظیر Vibe Coding…

گوگل با معرفی یک رابط چت، امکان شخصیسازی فید Discover را از طریق زبان طبیعی فراهم کرد. این بهروزرسانی کنترل محتوا را از ردیابی غیرفعال الگوریتمی به اراده و قصد مستقیم کاربر…

ابزار متنباز Vomit با انتقال خروجیهای بههمریخته مدل Claude 5 به یک مدل زبانی محلی، آنها را به متنی خوانا تبدیل میکند. این ابزار راهکاری کاملاً محلی و بدون نیاز به ارسال داده…

پژوهشگران MIT با توسعه یک خط لوله مبتنی بر مدلهای زبانی بزرگ، توانستند با تحلیل هفتهها مکالمات واقعی از طریق ساعتهای هوشمند، پاسخهای احتمالی بعدی کاربران را پیشبینی کنند. این…

مایک کاسبرگ با استفاده از Claude و مدلهای متنباز، یک صفحه ساعت سفارشی برای سختافزار ارزانقیمت PineTime ساخت. این پروژه نشان میدهد چگونه جریانهای کاری عاملمحور میتوانند…

نسخه پیشانتشار ۰.۳۲.۱۵ اولاما با معرفی حافظهٔ متاداده، سربار هر درخواست را حذف میکند. این بهروزرسانی نشان میدهد که سرعت نهایی تجربه کاربر، فراتر از نرخ تولید توکن و وابسته به…

اپلیکیشن RollTab با استفاده از یک ترنسفورمر تخصصی، قادر است ملودیهای پیانو را بهصورت آنی و روی دستگاه (On-device) تکمیل کند. این پروژه ثابت میکند که پاکسازی دقیق دادهها و…

پژوهش جدید دانشگاه استنفورد نشان میدهد مدلهای زبانی کوچک (SLM) که روی سختافزار محلی اجرا میشوند، بهسرعت در حال پر کردن شکاف عملکرد با مدلهای ابری هستند. این تغییر میتواند…