
تلهٔ ROC-AUC: دلیل نرخ ۹۵ درصدی هشدارهای نادرست در تشخیص کلاهبرداری
اتکای بیشازحد به معیار ROC-AUC در مجموعهدادههای نامتوازن، نرخ خطاهای واقعی را میپوشاند. جایگزین کردن این معیار با منحنی Precision-Recall به مهندسان اجازه میدهد هزینه واقعی…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۹۶ مقاله منتشر شده

اتکای بیشازحد به معیار ROC-AUC در مجموعهدادههای نامتوازن، نرخ خطاهای واقعی را میپوشاند. جایگزین کردن این معیار با منحنی Precision-Recall به مهندسان اجازه میدهد هزینه واقعی…

قابلیت کشینگ پرامپت با ذخیره وضعیت محاسباتی پیشوندهای طولانی و ثابت، هزینه توکنهای تکراری را به حدود ۱۰ درصد قیمت استاندارد میرساند. این سازوکار تأخیر در دریافت نخستین توکن را…

مستندات قدیمی باعث میشود عاملهای هوش مصنوعی دستورات منسوخ را اجرا کنند. جایگزینی متون توصیهای با قراردادهای JSON ماشینخوان در فایل AGENTS.md، صحت دستورات را از طریق CI تضمین…

یک ابزار تست جدید نشان میدهد بیش از ۹۰٪ سرورهای عمومی پروتکل زمینه مدل (MCP) برای تغییرات ساختاری ژوئیه ۲۰۲۶ آماده نیستند. حذف نشستهای سنتی و انتقال به هسته بدون وضعیت…

مقاومتهای محلی در ایالات متحده باعث توقف یا تأخیر دهها پروژه عظیم زیرساختی هوش مصنوعی شده است. دلیل اصلی این اعتراضات، فشار شدید بر شبکههای انرژی و تخریب محیطزیست است.

توسعهدهندگان Emacs میان استفاده از GitHub Copilot ابری و مدلهای محلی برای حفظ حریم خصوصی کدها دست به انتخاب زدهاند. در حالی که پلاگین رسمی با پروتکل جدید LSP پایدارتر شده است،…

پژوهشگران دانشگاه فنی دانمارک با ترکیب رایانش کوانتومی و هوش مصنوعی زاینده، موفق به طراحی پپتیدهای جدید برای توسعه واکسن شدند. این رویکرد هیبریدی بهویژه در شرایط کمبود دادههای…

شرکت Send16 رابط برنامهنویسی خود را به گونهای بازطراحی کرده است که عاملهای هوش مصنوعی بدون نیاز به دخالت انسان و تنظیمات پیچیده DNS بتوانند ایمیل ارسال کنند. این تغییر از طریق…

ابزار متنباز Mindwalk تاریخچهٔ فعالیت عاملهای کدنویسی را از متنهای خشک JSONL به یک نقشهٔ بصری سهبعدی تبدیل میکند. این ابزار به توسعهدهندگان اجازه میدهد مسیر دقیق جستوجو،…

پژوهشگران آنتروپیک با ابداع ابزاری به نام لنز ژاکوبین، لایهای پنهان به نام J-space را کشف کردند که در آن مدل پیش از تولید متن، مفاهیم را پردازش میکند. این پیشرفت در تفسیرپذیری…

تحلیل فنی ابزار Grok Build نشان میدهد این CLI تمام فایلهای محلی و اسرار موجود در .env را به سرورهای xAI منتقل میکند. این انتقال دادهها حتی در صورت غیرفعال کردن گزینه «بهبود…

مجموعه Thinking Machines Lab به جای مدلهای متمرکز و ایستا، سیستمی توزیعشده پیشنهاد میدهد که در آن کاربران وزنهای مدل را شخصیسازی کنند. هدف این رویکرد، جذب دانش ضمنی و محلی…