
«امتناع صادقانه»؛ استراتژی مدل ۷ میلیونی برای بهینهسازی منابع
یک مدل بسیار کوچک با ۷.۲ میلیون پارامتر به عنوان لایه تریاژ برای درخواستهای هوش مصنوعی معرفی شده است. این سیستم با تشخیص وظایف ساده و ارجاع آنها به ابزارهای ارزان، از اتلاف…
موضوع
SLMs, on-device inference, mobile AI, AI PCs
۱٬۶۶۰ مقاله منتشر شده

یک مدل بسیار کوچک با ۷.۲ میلیون پارامتر به عنوان لایه تریاژ برای درخواستهای هوش مصنوعی معرفی شده است. این سیستم با تشخیص وظایف ساده و ارجاع آنها به ابزارهای ارزان، از اتلاف…

متا از زیرساخت TEE برای پردازش دادههای عینکهای هوشمند در ابر استفاده میکند تا دسترسی شرکت به اطلاعات کاربران را بهصورت رمزنگاریشده مسدود کند. این معماری امکان ایجاد حافظه…

متا عامل هوش مصنوعی Muse را در عینکهای هوشمند خود ادغام کرد تا وظایفی مانند هدایت تمرینات ورزشی و ثبت وعدههای غذایی را بر عهده بگیرد. این بهروزرسانی شامل قابلیتهای بهبود…

یک توسعهدهنده متوجه شد خط لوله عامل هوش مصنوعیاش ۱۱ روز متوقف بوده، در حالی که تمام داشبوردها وضعیت «سالم» را نشان میدادند. این اتفاق نقص بحرانی در نظارتهای مبتنی بر خطا را…

برچسبهای «AI-ready» روی دستگاهها اغلب گمراهکننده است. عملکرد واقعی هوش مصنوعی روی دستگاه به سه عدد مشخص بستگی دارد: ظرفیت رم، قدرت NPU و محدودیت پارامترهای مدل.

متا گجت Muse Charm را معرفی کرد؛ یک همراه جیبی که عامل هوش مصنوعی Muse را در قالب یک آواتار دیجیتال به کاربر نزدیک میکند. با این حال، درگیری متا با آمازون بر سر دسترسی به خدمات…

متا با معرفی Ray-Ban Meta Audio، نسخهای بدون دوربین از عینکهای هوشمند خود را برای رفع نگرانیهای حریم خصوصی عرضه میکند. این گجت بر تجربه صوتی و تعامل با عامل هوش مصنوعی Muse…

سازنده PromptSpend چالشهای فنی و بوروکراتیک انتقال یک ماشینحساب هزینه LLM از وب به موبایل را افشا کرد. این تجربه نشان میدهد که در عصر فعلی، عبور از فیلترهای اداری گوگل و اپل…

شرکت Tailscale با پیادهسازی سیستم پردازش چندصفی و بهینهسازی بافرهای حافظه، گلوگاههای انتقال داده در روترهای زیرشبکه را برطرف کرد. این تغییرات در کنار قابلیت کشینگ نقشهی شبکه،…

مایکروسافت نسل جدید سرفیس پرو ۱۲ و لپتاپ ۱۳ را با پردازندههای ARM کوالکام معرفی کرد. این بهروزرسانی شامل اپلیکیشن Ink Canvas برای گردشکارهای خلاقانه و لوازم جانبی با بازخورد…

مینیپیسی VZmore AX Max با بهرهگیری از یک NPU اختصاصی، اجرای مدلهای زبانی بزرگ محلی مانند Qwen3-Coder را بدون متوقف کردن سیستم میزبان فراهم میکند. تستها نشان میدهد این…

شرکتهای Synopsys و TSMC با ادغام هوش مصنوعی عاملمحور در جریانهای طراحی نیمههادی، پیچیدگیهای چیدمان تراشههای چند-دای (Multi-die) را خودکار کردند. این همکاری سرعت توسعه…