
یک معادله چهارخطی؛ موتور ریاضیاتی پشت مدلهای GPT و Claude
مکانیزم «توجه» (Attention) که در سال ۲۰۱۷ معرفی شد، پردازش ترتیبی متن را با محاسبات موازی جایگزین کرد. این فناوری به هر توکن اجازه میدهد بهطور همزمان با تمام توکنهای دیگر…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۹۴ مقاله منتشر شده

مکانیزم «توجه» (Attention) که در سال ۲۰۱۷ معرفی شد، پردازش ترتیبی متن را با محاسبات موازی جایگزین کرد. این فناوری به هر توکن اجازه میدهد بهطور همزمان با تمام توکنهای دیگر…

یک برنامهنویس ۱۵ ساله برزیلایی با ابداع CELN، شبکههای عصبی را با معماریهای نمادین برداری جایگزین کرد. این سیستم بدون نیاز به GPU، در آزمونهای استدلال منطقی به نمره کامل رسید.

یک قالب ارزیابی استاندارد جدید، سنجش ابزارهای کدنویسی هوش مصنوعی را از بنچمارکهای عمومی به سمت کدبیسهای واقعی و اختصاصی میبرد. این روش با تمرکز بر پیچیدگی «افق زمانی» و مقایسه…

توسعهدهندگانی از OpenClaw با پیادهسازی یک مرورگر مخفی به عنوان سرور MCP، نرخ شکست در عبور از سیستمهای ضدبات را کاهش دادند. این ساختار اجازه میدهد عاملها فقط هنگام مواجهه با…

پلتفرم Morph از طریق سیستم Reflexes، نظارت بر رفتارهای پیچیده عاملهای هوش مصنوعی را با تأخیری کمتر از ۳۰ میلیثانیه ممکن کرد. این فناوری با جایگزینی مدلهای داور گرانقیمت با یک…

شرکت Cerebrium با معرفی سیستمی برای ثبت وضعیت حافظه CPU و GPU، فرآیند طولانی مقداردهی اولیه مدلهای هوش مصنوعی را حذف کرد. این فناوری زمان «راهاندازی سرد» را در برخی مدلها تا…

شرکت آنتروپیک با پذیرش حفاظهای امنیتی جدید و مسدود کردن قابلیتهای حساس، دسترسی به مدل Fable 5 را بازگرداند. این تصمیم پس از تقابل شدید با دولت ترامپ بر سر آسیبپذیریهای سایبری…

عاملهای هوش مصنوعی در برابر «مسمومسازی حافظه» آسیبپذیرند؛ تکنیکی که دستورات مخرب را در حافظه بلندمدت مدل میکارد تا رفتارهای آینده را دستکاری کند. این تهدید، تمرکز امنیتی را از…

پلتفرم LiteLLM برای حذف سربار بافری در مسیرهای عاملهای بیدرنگ، زیرساخت گیتوی خود را از پایتون به زبان Rust منتقل کرد. این تغییر باعث کاهش چشمگیر تأخیر در هر درخواست شده و امکان…

یک نظریه فنی جدید استدلال میکند که شکست عاملهای هوش مصنوعی در وظایف طولانی، ناشی از کمبود داده نیست، بلکه یک «مشکل توجه» است. راهکار پیشنهادی، جایگزینی مدل «کشیدن اطلاعات» با یک…

بیشتر مدلهای زبانی به دلیل آموزشهای مشابه، دچار «تفکر جمعی» شده و پاسخهای پیشبینیپذیری میدهند. استارتاپ Springboards با مدل Flint، مکانیزمی برای تزریق تصادفیسازی گزینشی…

نخستین پنل علمی مستقل سازمان ملل هشدار داد که دوبرابر شدن قابلیتهای مدلها در بازههای کوتاه، سیاستگذاران را ناتوان از اجرای حفاظهای ایمنی کرده است. این گزارش بر ضرورت همکاری…