
چرا برای بهینهسازی GPU دیگر نیازی به یادگیری C++ نیست؟
انویدیا با معرفی cuTile Python، امکان نوشتن هستههای GPU را مستقیماً در محیط پایتون فراهم کرد. این ابزار با حذف نیاز به جابهجایی میان پایتون و C++، سرعت توسعه و بهینهسازی…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۵۵ مقاله منتشر شده

انویدیا با معرفی cuTile Python، امکان نوشتن هستههای GPU را مستقیماً در محیط پایتون فراهم کرد. این ابزار با حذف نیاز به جابهجایی میان پایتون و C++، سرعت توسعه و بهینهسازی…

بسیاری از توسعهدهندگان به اشتباه از دیتابیسهای برداری پیچیده و گرانقیمت استفاده میکنند. در مقیاسهای متوسط، جایگزینهای سادهتری مثل pgvector عملکرد مشابهی دارند و هزینهها را…

خطاهای سیستمهای هوش مصنوعی حقوقی، مانند استنادهای ساختگی، ریشه در نقص معماری و عدم تطابق بازیابی احتمالی با ساختار سلسلهمراتبی قوانین دارند. چارچوب پیشنهادی جدید با رویکرد…

چارچوب CARE یک لایه ایمنی مستقل از مدل است که ضمانتهای ریاضیاتی علیه توهمات و حذف دادههای حیاتی در خلاصههای پزشکی ارائه میدهد. این سیستم با کاهش چشمگیر هشدارهای غیرضروری و…

پروژه Loro با معرفی «کانتینرهای ادغامپذیر»، باگ قدیمی حذف داده در ساختارهای CRDT را برطرف کرد. این راهکار با جایگزینی شناسههای مبتنی بر عملیات با شناسههای قطعی منطقی، ریسک…

یک توسعهدهنده با ترکیب Claude Opus 4.6 و ابزارهای خط فرمان، زمان مهندسی معکوس بایوس ThinkPad x61 را از ۶ ماه به چند هفته کاهش داد. با این حال، توهمات مدل در جزئیات سختافزاری…

چارچوب جدیدی به نام اپراتورهای عصبی توپولوژیک (TNOs) با بهرهگیری از حساب خارجی گسسته، یادگیری اپراتورها را به دامنههای توپولوژیک منتقل میکند. این رویکرد به هوش مصنوعی اجازه…

پژوهشگران با معرفی روش انتشار کرانهای زمانی-مکانی (STBP)، دقت اثباتشده در شبکههای عصبی سه-بعدی را ۱.۷ برابر افزایش دادند. این چارچوب به جای تکیه بر نویزهای تصادفی، محدودیتهای…

چارچوب الگوریتمیک جدیدی به نام Dri-MED ابداع شده است که میتواند سیستمهای توصیهگر را با تغییرات لحظهای ترجیحات کاربران و توزیع زمینهها تطبیق دهد. این روش با تبدیل مسائل ناپایا…

چارچوب AHA-WAM با جداسازی پیشبینی جهان از اجرای عملیات، تأخیر کنترل بسته-حلقه در رباتها را ۴.۵۹ برابر کاهش داده است. این معماری مبتنی بر ترنسفورمرهای انتشار دوگانه، امکان کنترل…

پژوهشگران بنچمارک OmniGameArena را برای اندازهگیری نحوه بهبود عاملهای مدل زبانی-دیداری از طریق بازتاب خودکار معرفی کردهاند. برخلاف تابلوهای امتیازات ایستا، این سیستم مسیر…

یک تکنیک جدید در یادگیری تقویتشده (RL) با جایگزینی آموزش «از صفر» با انتقال تدریجی کنترل از یک خطمبنای عملیاتی به شبکه عصبی، هزینههای محاسباتی را کاهش میدهد. این روش نرخ رسیدن…