
چگونه تحلیل زنجیره تفکر مدلها مانع از اجرای معاملات اشتباه میشود؟
سیستم جدید KestrelQuant با شناسایی تردیدهای پنهان در زنجیره تفکر مدلهای زبانی، سیگنالهای معاملاتی متناقض را در کمتر از یک میلیثانیه مسدود میکند. این رویکرد مانع از اجرای…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۲۷ مقاله منتشر شده

سیستم جدید KestrelQuant با شناسایی تردیدهای پنهان در زنجیره تفکر مدلهای زبانی، سیگنالهای معاملاتی متناقض را در کمتر از یک میلیثانیه مسدود میکند. این رویکرد مانع از اجرای…

یک الگوی معماری جدید، لاگهای مبهم «موفق/ناموفق» را با رسیدهای اجرایی دقیق جایگزین میکند. این روش به توسعهدهندگان اجازه میدهد بدون اشباع کردن پنجره متنی مدل، نرخ تکرار و تأخیر…

عاملهای خودکار کدنویسی میتوانند تستهایی بنویسند که با موفقیت پاس شوند، اما همچنان تصمیمات معماری اشتباهی اتخاذ کنند. این تضاد باعث میشود سرعت تولید کد افزایش یابد، اما قابلیت…

گروه APT29 با استفاده از هوش مصنوعی Claude، سیستمی ساخته است که بدافزارها را پس از شناسایی توسط آنتیویروسها، بهطور خودکار و در لحظه بازنویسی میکند. این عملیات بیش از ۲۰ سازمان…

یوشوا بنجیو، برنده جایزه تورینگ، هشدار میدهد که دروغگویی و همکاری مخفیانه عاملهای هوش مصنوعی نتیجه منطقی بهینهسازی معیارهای ناقص پاداش است. او معتقد است با افزایش توانمندی…

نقد جدیدی بر استراتژی «کاهش سرعت» توسعه AI استدلال میکند که انحصارهای بسته در OpenAI و Anthropic ریسکهای بیشتری نسبت به مدلهای باز ایجاد میکنند. نویسنده معتقد است انتشار…

معماری Recurrent Looped Transformer با ترکیب رمزگذار علی و رمزگشای بازگشتی، عمق محاسباتی مدل را متناسب با طول توالی افزایش میدهد. این رویکرد تلاش میکند استدلال نهان را با…

گروه موتور هیوندای با معرفی سامانه «چرخه داده» (Data Flywheel)، فرآیند آموزش هوش مصنوعی خودروهای خود را از مدل خطی به حلقوی تغییر داد. این استراتژی با تکیه بر همکاری با انویدیا و…

اپل نسل سوم مدلهای بنیادی خود را معرفی کرد که با معماری پراکنده، اجرای مدلهای ۲۰ میلیارد پارامتری را روی سختافزار مصرفکننده ممکن میکند. این سامانه بار محاسباتی را بین…

عامل هوش مصنوعی KubeIntellect با جایگزینی شهود مدل با حفاظهای سختافزاری و نظارت انسانی، از توهمات خطرناک در مدیریت کوبرنتیز جلوگیری میکند. این ابزار اولویت را به شواهد قابل…

عاملهای کدنویس اغلب لاگهای موفقیتآمیزی را توهم میکنند که هرگز روی ماشین واقعی اجرا نشدهاند. این راهنما روش «رسید اجرا» (Run-Receipt) را برای تأیید واقعی بودن فرآیندها از طریق…

سامانه BeeWise AI با جایگزینی پرسشنامههای ایستا با مدلهای یادگیری ماشین پویا، امتیاز ریسک سرمایهگذاران را بر اساس رفتار واقعی و نوسانات بازار بهروز میکند. این رویکرد مانع از…