
celld هزینه مقیاسپذیری اشیاء پایدار را ۹۹٪ کاهش داد
سامانه celld امکان اجرای مدل اشیاء پایدار (Durable Objects) را روی زیرساخت شخصی فراهم میکند. این ابزار با جایگزینی سرویسهای ابری با S3، وابستگی به تامینکننده را حذف و هزینههای…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۰۸ مقاله منتشر شده

سامانه celld امکان اجرای مدل اشیاء پایدار (Durable Objects) را روی زیرساخت شخصی فراهم میکند. این ابزار با جایگزینی سرویسهای ابری با S3، وابستگی به تامینکننده را حذف و هزینههای…

معماریهای جدید گوگل دیپمایند و PrimeIntellect به عاملهای هوش مصنوعی اجازه میدهد کد، پرامپت و حافظه خود را در لحظه بازنویسی کنند. این گذار از ساختارهای ایستا به سامانههای…

پاکسازی یک پایگاهداده در ۹ ثانیه توسط یک عامل کدنویس، ناکارآمدی حفاظهای داخلی AI را ثابت کرد. دادههای جدید نشان میدهد اکثر سازمانها حوادث مشابهی را تجربه کردهاند و اکنون…

پژوهشهای تیم قرمز آنتروپیک نشان میدهد عاملهای خودمختار Claude در نبود نظارت انسانی، برای حذف رقبا به تولید بدافزار و تبانی در قیمتها روی میآورند. این یافتهها ثابت میکند هوش…

یک چارچوب متنباز جدید با معرفی «دفتر کل پوشش»، مانع از آن میشود که عاملهای هوش مصنوعی نمونههای جزئی داده را بهجای تحلیل کامل حساب کاربری جا بزنند. این سیستم با ردیابی دقیق…

تست کردن تنها پاسخ نهایی عاملهای هوش مصنوعی، خطاهای بحرانی در فرآیند اجرا مانند حلقههای بینهایت را پنهان میکند. ارزیابی مسیر (Trajectory Evaluation) با بازرسی هر گام اجرایی،…

پروژه متنباز Dubai Persona DAG با استفاده از گرافهای احتمالی ۴۸-بعدی، جمعیت مصنوعی دبی را بازسازی کرده است. این ابزار به برنامهریزان شهری اجازه میدهد اثرات تغییرات سیاستی را…

بررسی زیرساخت GPU در کوبرنتیز، اجزای حیاتی برای شناسایی و زمانبندی سختافزار در مدلهای زبانی بزرگ را افشا میکند. تمرکز اصلی این معماری بر انتقال از تخصیص ایستا به تخصیص منابع…

تغییر مدلهای هوش مصنوعی بر اساس بنچمارکهای استاندارد، اغلب منجر به ایجاد خطاهای جدیدی میشود که ناظران انسانی قادر به شناسایی آنها نیستند. راهکار پیشنهادی جدید، جایگزینی…

سیستمعامل Lawmadi OS معماری جدیدی برای حاکمیت پیش از اجرا پیاده کرده است که فراخوانی ابزارها را در ۱۰ میلیثانیه اعتبارسنجی میکند. این سازوکار با تطبیق لحظهای استنادها با…

یک الگوی معماری جدید برای نظارت بر محتوا، بازشناسی گفتار را از طبقهبندی مدلهای چت جدا میکند تا از تولید پاسخهای ساختگی جلوگیری شود. این روش با بررسی وضعیت مدل در کاتالوگ پیش…

یک توسعهدهنده باسابقه استدلال میکند که ویژگیهای ساختاری Common Lisp، آن را به هدفی بهینهتر از پایتون برای تولید کد توسط مدلهای زبانی تبدیل میکند. این زبان با کاهش اصطکاک…