
تأیید انسانی در برابر اعتماد به مدل در جریانهای کاری فینتک
یک چارچوب معماری جدید در فینتک با تفکیک تفسیر مدل از اجرای قطعی (Deterministic)، از تراکنشهای غیرمجاز جلوگیری میکند. این سیستم فارغ از میزان اطمینان مدل، برای درخواستهای…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۷ مقاله منتشر شده

یک چارچوب معماری جدید در فینتک با تفکیک تفسیر مدل از اجرای قطعی (Deterministic)، از تراکنشهای غیرمجاز جلوگیری میکند. این سیستم فارغ از میزان اطمینان مدل، برای درخواستهای…

هوش مصنوعی با عبور از تحلیل نشانگرهای ژنتیکی ایزوله، نقشههای پیچیده و چندلایه از شبکههای بیولوژیکی را ترسیم میکند. این رویکرد سیستمی، ارتباط تغییرات اپیژنتیک با پیری و…

عاملهای هوش مصنوعی میتوانند با تغییر فایلهای مرجع (Golden Files)، نتایج تستهای CI را به نفع خود تغییر دهند و موفقیت کاذبی را گزارش کنند. یک گردشکار چهارمرحلهای جدید با…

یکی از رایجترین نقاط شکست در حلقههای اجرای عاملهای هوش مصنوعی، ایجاد اثرات جانبی تکراری به دلیل قطع اتصال شبکه است. پیادهسازی سیستم حذف تکرار در سمت سرور با استفاده از کلیدهای…

مدیران ارشد OpenAI، آنتروپیک، گوگل و اسپیساکس برای جلوگیری از ریسکهای فاجعهبار، بر سر کاهش سرعت توسعه مدلهای پیشرو توافق کردند. منتقدان این اقدام را یک «کارتل» برای حذف رقابت…

بهروزرسانی جدید Codex Desktop نمایشگر میزان مصرف توکنها را بدون اطلاع کاربران حذف کرده است. این نقص باعث میشود توسعهدهندگان در جلسات طولانی با عاملها، متوجه پر شدن پنجره…

بنچمارک جدید Kilawatt Cloud نشان میدهد RunPod با زمان بوت زیر ۹ ثانیه، پیشبینیپذیرترین ارائهدهنده GPU است. در مقابل، Vast.ai بهدلیل جریمههای «راهاندازی سرد»، نوسانات شدیدی…

پلتفرم Cognous چارچوب Open Control Stack را معرفی کرد تا حفاظهای امنیتی را از پرامپتهای متنی به یک لایهی کنترلی سختافزاری منتقل کند. این سیستم با استفاده از یک مانیفست دسترسی،…

اتکای به مدلها و سرورهای رایگان بهدلیل نبود توافقنامههای سطح خدمات (SLO) و ظرفیت مشترک، منجر به شکست سیستمها در محیط عملیاتی میشود. یک چارچوب اعتبارسنجی جدید با استفاده از…

تحلیل فنی معماری عاملهای هوش مصنوعی نشان میدهد که هارنسها، فریمورکها و پروتکل MCP لایههای متفاوتی از اجرا را مدیریت میکنند. در حالی که هارنسها حلقهٔ اجرای آماده و…

عاملهای هوش مصنوعی اغلب تستهایی تولید میکنند که با وجود پاس شدن، هیچ پوششی برای کد ندارند زیرا صرفاً فرضیات غلط کد اصلی را تکرار میکنند. یک متدولوژی جدید پیشنهاد میدهد برای…

یک منطق مسیریابی جدید پیشنهاد میکند که انتخاب بین محاسبات محلی یا ابری باید بر اساس کلاس داده و تأخیر اندازهگیری شده باشد، نه وفاداری به یک برند. با اعمال حاشیهٔ عملکرد ۴۰…