
چرا نتایج مدلهای زبانی با تغییر اندازهٔ Batch تغییر میکنند؟
تغییر اندازهٔ دستههای پردازشی (Batch Size) در رمزگشایی BF16 باعث تغییر توکنهای خروجی میشود و تکرارپذیری را از بین میبرد. روش MarginGate با بازبینی FP32 برای توکنهای حساس، این…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۷۵ مقاله منتشر شده

تغییر اندازهٔ دستههای پردازشی (Batch Size) در رمزگشایی BF16 باعث تغییر توکنهای خروجی میشود و تکرارپذیری را از بین میبرد. روش MarginGate با بازبینی FP32 برای توکنهای حساس، این…

معماری جدید Perplexity به مدلهای هوش مصنوعی اجازه میدهد بهجای استفاده از APIهای صلب، کدهای پایتون سفارشی برای جستوجو بنویسند. این تغییر منجر به کاهش شدید هزینههای عملیاتی و…

توسعهدهندگان سیستمهای پذیرش تماس باید بین مدلهای ترکیبی (انسان-هوش مصنوعی) و مدلهای خالص توازن برقرار کنند. در حالی که مدلهای ترکیبی برای تماسهای پیچیده امنیت ایجاد میکنند،…

عاملهای هوش مصنوعی که از پروتکل MCP استفاده میکنند، در صورت برخورد با سرورها بهعنوان پلاگینهای ساده، با ریسکهای امنیتی شدیدی مواجه میشوند. برای جلوگیری از حملات زنجیره…

پژوهشگران ثابت کردند که عملیات و اعداد ریاضی را میتوان مستقیماً از فعالسازهای داخلی مدلهای Llama استخراج کرد. این دستاورد اجازه میدهد ابزارهای خارجی بهجای تحلیل متنی پرامپت،…

یک راهنمای فنی جدید نشان میدهد چگونه با ترکیب Rust و Tauri میتوان پاسخهای Gemini را بهصورت استریمینگ نمایش داد. این روش با استفاده از SSE، زمان انتظار کاربر را حذف کرده و…

یک پسرفت فنی در macOS 0.30.6 باعث کرش مدل qwen3-embedding هنگام پردازش متنهای طولانی میشود. برای رفع این مشکل، کاربران باید به نسخه 0.24.0 بازگردند یا ورودیها را تکهتکه کنند.

نسخه ۰.۳۰.x ابزار Ollama به دلیل مدیریت تهاجمی حافظه Vulkan، باعث خطای کمبود حافظه (OOM) در کارتهای گرافیکی ۴ گیگابایتی شده است. این مشکل دسترسی به مدلهای کوانتیزه شده را مختل…

یک پیشنهاد نظری جدید ادعا میکند که دستیابی به هوش سطح انسانی نیازمند «پرتاب» (Catapulting) مدلهای بسیار بزرگ از طریق چرخههای نرخ یادگیری بالاست. این رویکرد، اولویت را از حجم…

ابزار Garak از شرکت NVIDIA فرآیند تست نفوذ یا همان Red-teaming را برای مدلهای زبانی خودکار میکند. این چارچوب با جایگزینی تستهای دستی با معیارهای عددی، به توسعهدهندگان اجازه…

شرکت Anthropic گزارش داد که مدل Claude اکنون بخش اعظم کدهای محیط تولید را مینویسد و دیگر صرفاً یک دستیار نیست. این چرخش، سرعت پیادهسازی پروژهها را ۸ برابر کرده و بازه زمانی…

یک معماری جدید برای هوش مصنوعی حقوقی، جستجوی برداری ساده را با سیستم بازیابی ترکیبی و ارزیابی برنامهریزیشده جایگزین کرده است. این روش توهمات را حذف کرده و استنادات دقیق به اسناد…