
مدل Jev و پذیرش خطاهای توجیهناپذیر در توسعهٔ نرمافزارهای AI
ظهور مدلهای ارزان و سریع مانند Jev، توسعهدهندگان را به عرضهٔ نرمافزارهای بدون تست سوق میدهد. این روند در حال تبدیل کردن «خطاهای سیستمی» به ویژگیهای پذیرفتهشده است و جایگزین…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۶۶۶ مقاله منتشر شده

ظهور مدلهای ارزان و سریع مانند Jev، توسعهدهندگان را به عرضهٔ نرمافزارهای بدون تست سوق میدهد. این روند در حال تبدیل کردن «خطاهای سیستمی» به ویژگیهای پذیرفتهشده است و جایگزین…

مطالعهای روی مدل Atria Dawn Preview نشان میدهد که عاملهای هوش مصنوعی اکنون اکثریت مراحل فنی توسعه مدلها را اجرا میکنند، اما قدرت تصمیمگیری حیاتی همچنان در دست انسان است. این…

پژوهشی جدید نشان میدهد جملات سلب مسئولیت رایج در مدلهای زبانی، نه حاصل وزنهای داخلی مدل، بلکه نتیجهی قالبهای چت (Chat Templates) هستند. محققان با دستکاری بردارهای فعالسازی…

یک معماری جدید هوش مصنوعی با استفاده از یادگیری خودنظارتی، الگوهای پنهان اقلیمی را بدون نیاز به دادههای برچسبدار شناسایی میکند. این سیستم محدودیتهای قانونی و سیاستهای شهری را…

شرکت Momenta، تأمینکننده زیرساختهای رانندگی خودکار، برای پذیرش در بورس هنگکنگ اقدام کرد. همزمان، شرکتهای DiDi و GAC Aion عملیات تاکسیهای بدون راننده خود را در پکن و گوانگژو…

پژوهشگران استنفورد و کالتک با ادغام GPT-6 Astra در ربات Unitree G1، لایههای سنتی کنترل سختافزار را حذف کردند. این سیستم به ربات اجازه میدهد بدون نقشه قبلی، محیط را شناسایی کرده…

آنتروپیک با معرفی Claude Opus 5.5 کف قیمتی استقرار عاملهای هوش مصنوعی در محیطهای عملیاتی را جابهجا کرد. همزمان، متا استراتژی سختافزاری خود را برای انتقال عاملها به عینکهای…

یک آزمایش کنترلشده روی کدهای واقعی نشان میدهد که ارسال کل سند بهجای تکههای کوچک، دقت مدلهای زبانی را در پرسوجوهای برنامهنویسی ۸۰۰٪ افزایش میدهد. این یافته ثابت میکند…

استاندارد پیشنهادی WebMCP به وبسایتها اجازه میدهد ابزارهای ساختاریافته را مستقیماً در اختیار عاملهای هوش مصنوعی قرار دهند. این رویکرد نیاز به استخراج دادههای بصری و شبیهسازی…

بنیانگذار ByteFlow چارچوبی عملی برای تفکیک میان گردشکارهای قطعی و عاملهای خودمختار ارائه داد. این راهنما نسبت به «افراط در استفاده از عاملها» هشدار میدهد و پیشنهاد میکند…

آزمونهای جدید نشان میدهد که تکیه بر پرامپت برای تضمین ایمنی و استقلال عاملهای هوش مصنوعی شکستخورده است. تنها راهکار موثر، جایگزینی دستورات متنی با کدهای قطعی (Deterministic)…

پلتفرمهای سرمایهگذاری خودکار از نظرسنجیهای تکمرحلهای به سمت خط لولههای یادگیری ماشین پیوسته حرکت میکنند. این سیستمها با تحلیل رفتار واقعی و ظرفیت مالی کاربر، سبد دارایی را…