
چرا مدلهای بزرگ در Ollama 0.30 روی کارتهای ۴ گیگابایتی کرش میکنند؟
نسخه ۰.۳۰.x ابزار Ollama به دلیل مدیریت تهاجمی حافظه Vulkan، باعث خطای کمبود حافظه (OOM) در کارتهای گرافیکی ۴ گیگابایتی شده است. این مشکل دسترسی به مدلهای کوانتیزه شده را مختل…
موضوع
SLMs, on-device inference, mobile AI, AI PCs
۱٬۰۸۹ مقاله منتشر شده

نسخه ۰.۳۰.x ابزار Ollama به دلیل مدیریت تهاجمی حافظه Vulkan، باعث خطای کمبود حافظه (OOM) در کارتهای گرافیکی ۴ گیگابایتی شده است. این مشکل دسترسی به مدلهای کوانتیزه شده را مختل…

پروژه Yumii یک دستیار هوشمند متنباز و محلی است که برخلاف مدلهای رایج، تماماً روی CPU اجرا میشود. این ابزار با ترکیب آواتارهای Live2D و حافظه بلندمدت، نیاز به سختافزارهای…

برنامهنویسان اکنون میتوانند به جای APIهای ابری، از سرور محلی Ollama برای اجرای عاملهای کدنویسی استفاده کنند. این ترکیب با مدل Qwen3-Coder:30B، نشت دادهها را متوقف و هزینههای…

شرکت Anthropic برای IPO تریلیون دلاری خود اقدام کرد، در حالی که اولین حمله سایبری کاملاً خودگردان توسط عاملهای هوش مصنوعی ثبت شد. انویدیا وارد بازار پردازندههای PC شد و اپل در…

گزارش فنی جدیدی نشان میدهد که ترکیب چهار مدل زبانی کوچک از آزمایشگاههای مختلف، رفتارهای ارگانیکتر و استراتژیهای اقتصادی پیچیدهتری را نسبت به یک مدل واحد ایجاد میکند. این…

اپل در کنفرانس WWDC ۲۰۲۶ سیری را به یک عامل هوشمند تبدیل میکند که با کمک گوگل Gemini کارهای پیچیده را بهطور مستقل انجام میدهد. هدف این تغییر، تبدیل آیفون از ابزاری که کاربر آن…

پلتفرم Job Searcher با استفاده از یک مدل کوچکِ تقطیرشده، فرآیند یافتن و امتیازدهی به مشاغل لینکدین را خودکار میکند. این سیستم با بهرهگیری از مدل DeepSeek V4 Pro به عنوان معلم،…

توسعهدهندگان اکنون میتوانند مدلهای PyTorch را بهجای شبیهسازی، مستقیماً روی سختافزارهای واقعی مانند گلکسی S24 بهینهسازی و اجرا کنند. این ابزار فاصله میان محیطهای آزمایشگاهی…

کاهش ابعاد بردارها در مدل text-embedding-3-small از ۱۵۳۶ به ۵۱۲، فضای مورد نیاز در دیتابیسهای برداری را ۶۷٪ کاهش میدهد. این تغییر باعث کاهش تأخیر و هزینهی حافظه میشود، اما…

متا با معرفی سرویس Hatch، نخستین محصول پولی خود را برای اتوماسیون کارهای حرفهای عرضه میکند. این اشتراک با قیمت ۲۰۰ دلار در ماه، مستقیماً با نسخههای پریمیوم OpenAI و Anthropic…

بررسیهای فنی نشان میدهد شرکت Bright Data با جاسازی SDK در اپلیکیشنهای شریک، تلویزیونهای هوشمند و گوشیها را به پروکسیهای مسکونی برای استخراج دادههای وب تبدیل کرده است. این…

گوگل با معرفی نقاط بازبینی جدید مبتنی بر آموزش آگاه از کوانتایزیشن (QAT)، مدل Gemma 4 E2B را به زیر ۱ گیگابایت حافظه رساند. این بهروزرسانی امکان اجرای مدلهای زبانی باکیفیت را…