
چرا مدلهای بزرگ در Ollama 0.30 روی کارتهای ۴ گیگابایتی کرش میکنند؟
نسخه ۰.۳۰.x ابزار Ollama به دلیل مدیریت تهاجمی حافظه Vulkan، باعث خطای کمبود حافظه (OOM) در کارتهای گرافیکی ۴ گیگابایتی شده است. این مشکل دسترسی به مدلهای کوانتیزه شده را مختل…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۲۰ مقاله منتشر شده

نسخه ۰.۳۰.x ابزار Ollama به دلیل مدیریت تهاجمی حافظه Vulkan، باعث خطای کمبود حافظه (OOM) در کارتهای گرافیکی ۴ گیگابایتی شده است. این مشکل دسترسی به مدلهای کوانتیزه شده را مختل…

یک پیشنهاد نظری جدید ادعا میکند که دستیابی به هوش سطح انسانی نیازمند «پرتاب» (Catapulting) مدلهای بسیار بزرگ از طریق چرخههای نرخ یادگیری بالاست. این رویکرد، اولویت را از حجم…

ابزار Garak از شرکت NVIDIA فرآیند تست نفوذ یا همان Red-teaming را برای مدلهای زبانی خودکار میکند. این چارچوب با جایگزینی تستهای دستی با معیارهای عددی، به توسعهدهندگان اجازه…

شرکت Anthropic گزارش داد که مدل Claude اکنون بخش اعظم کدهای محیط تولید را مینویسد و دیگر صرفاً یک دستیار نیست. این چرخش، سرعت پیادهسازی پروژهها را ۸ برابر کرده و بازه زمانی…

یک معماری جدید برای هوش مصنوعی حقوقی، جستجوی برداری ساده را با سیستم بازیابی ترکیبی و ارزیابی برنامهریزیشده جایگزین کرده است. این روش توهمات را حذف کرده و استنادات دقیق به اسناد…

نسخه ۲.۰ کتابخانه Symbolica با معرفی «نمادهای برنامهپذیر» و کامپایل JIT، سرعت پردازشهای ریاضی پیچیده را تا ۱۰ هزار برابر افزایش داده است. این بهروزرسانی با ارائه دقت ۳۱ رقم…

مجموعه تشخیصی Scarab فرآیند دیباگ در هوش مصنوعی را از تعمیر واکنشی به پیشگیری فعال تغییر میدهد. این ابزار «تزلزل حقیقت نرمافزاری» را در لحظه شناسایی کرده و مانع انباشت بدهی فنی…

اعتماد صرف به تاریخچهٔ گفتگو برای ایجاد حافظه در عاملهای هوش مصنوعی بهدلیل محدودیتهای استدلالی مدلها ناکارآمد است. راهکار جایگزین، استقرار یک معماری سهلایه شامل حافظه…

یک الگوی مهندسی جدید به مدلهای بزرگ اجازه میدهد تا حافظهی مدلهای کوچکتر را بهصورت پویا ویرایش و بازنویسی کنند. این روش نویز را حذف و دقت را بالا میبرد، اما ریسک افزایش شدید…

عاملهای هوش مصنوعی معمولاً کدهای HTML تولید میکنند که اشتراکگذاری آنها بدون یک خط لولهی استقرار (Deployment Pipeline) دشوار است. استکتری (Stacktree) با استفاده از پروتکل…

شرکت Anthropic برای IPO تریلیون دلاری خود اقدام کرد، در حالی که اولین حمله سایبری کاملاً خودگردان توسط عاملهای هوش مصنوعی ثبت شد. انویدیا وارد بازار پردازندههای PC شد و اپل در…

شکست عاملهای هوش مصنوعی در محیط عملیاتی معمولاً نتیجهی طراحی ضعیف اطلاعات است، نه نقص در وزنهای مدل. یک چارچوب جدید، پنج تکنیک مبنیسازی را برای متوقف کردن توهمات در مقیاس…