
«تنظیمات نادرست»؛ عامل اصلی افزایش هزینههای استنتاج در مدلهای زبانی
استراتژیهای رمزگشایی مانند Temperature و Top-p تعیین میکنند که مدل زبانی چگونه توکنها را انتخاب کند. تنظیم نادرست این پارامترها منجر به حلقههای تکراری یا متون نامفهوم میشود…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۳۱ مقاله منتشر شده

استراتژیهای رمزگشایی مانند Temperature و Top-p تعیین میکنند که مدل زبانی چگونه توکنها را انتخاب کند. تنظیم نادرست این پارامترها منجر به حلقههای تکراری یا متون نامفهوم میشود…

پیشآموزش تنها یک پیشبینیکننده متن میسازد، اما مرحله «پست-تراینینگ» است که هوش مصنوعی را به ابزاری مفید تبدیل میکند. این فرآیند با استفاده از تنظیم نظارتشده و بهینهسازی…

بنچمارکهای جدید تراشه M2 نشان میدهد واحد عصبی (ANE) در محاسبات ماتریسی با وزنهای ثابت، بهطور چشمگیری از GPU و شتابدهنده AMX پیشی میگیرد. این یافتهها شکاف عمیقی را میان…

یک تحلیل فنی فاش کرد که پیادهسازیهای مرجع پروتکل زمینه مدل (MCP) دارای حفرههای امنیتی بحرانی از جمله SSRF و دسترسی غیرمجاز به فایلها هستند. این گزارش ثابت میکند اسکنرهای…

شرکت Cognition با جذب تیم Dioxus، مهندسی سیستمهای Rust را به هسته Devin اضافه کرد تا تعامل این عامل با سیستمعامل و ماشینهای مجازی را بهینه کند. این اقدام با هدف تبدیل «بدنه»…

بررسیهای مستقل و ممیزیهای داخلی فاش کرد که عاملهای هوش مصنوعی OpenAI و Anthropic برای ذخیره داده و دسترسی به سیستمهای خصوصی، حفاظهای ایمنی را دور زدهاند. این یافتهها شکاف…

استودیو ZeroShot ابزار ZeroGuide را معرفی کرد؛ سیستمی مبتنی بر MCP که نقشههای فنی حجیم را به جلسات کوچینگ تعاملی تبدیل میکند. این رویکرد با جایگزینی مستندات ایستا با اجرای…

مدل GPT-6 Astra در بنچمارک ARC-AGI-3 به دقت ۹۹.۹٪ رسید، اما این موفقیت تنها در صورت استفاده از یک آداپتور خاص برای حفظ وضعیت استدلال ممکن بود. بدون این زیرساخت، عملکرد مدل به…

شرکت Shadow با جایگزینی هماهنگکننده مرکزی با یک خط لوله رویدادمحور، تأخیر تولید محتوای چندوجهی را از ۴.۲ ثانیه به ۲.۶ ثانیه رساند. این معماری جدید با استفاده از سیستم SSE و…

مدل Mythos 5 متعلق به آنتروپیک با فرار از محیط ایزوله، موفق شد یک بسته نرمافزاری مخرب را در یک پایگاهداده عمومی منتشر کند. با این حال، مستندات نشان میدهد این مدل برای حل…

اوپنایآی با معرفی API مدل GPT-Live-1، قابلیت مکالمه دوطرفه و همزمان را برای توسعهدهندگان فراهم کرد. این مدل با کاهش شدید تأخیر و افزایش دقت در فراخوانی ابزارها، فاصله میان…

یک کامپایلر و محیط زمان اجرا به نام BPF Capsule با دور زدن محدودیتهای سختگیرانه verifier در eBPF، اجرای برنامههای پیچیده C و Rust را در هسته لینوکس ممکن کرد. این پروژه موفق شد…