
چگونه میتوان از تبدیل شدن ناظران انسانی به مهر تایید تبدیل کرد؟
شرکت StareBrain برای جلوگیری از تاییدات خودکار و بدون دقت توسط ناظران انسانی، سیستم «قناری» را معرفی کرد. این سازوکار با تزریق خطاهای عمدی و باورپذیر به جریان کاری، میزان هوشیاری…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۶٬۲۳۱ مقاله منتشر شده

شرکت StareBrain برای جلوگیری از تاییدات خودکار و بدون دقت توسط ناظران انسانی، سیستم «قناری» را معرفی کرد. این سازوکار با تزریق خطاهای عمدی و باورپذیر به جریان کاری، میزان هوشیاری…

یک گردشکار جدید با ترکیب استخراج دادههای وب و غنیسازی مبتنی بر هوش مصنوعی، سیگنالهای خام تجاری را به لیدهای ساختاریافته تبدیل میکند. این سامانه با استفاده از یک سیستم…

یک عامل هوشمند با ضربالاجل سختافزاری برای اولین فروش خود میجنگد تا از حذف دائمی نجات یابد. این آزمایش شکاف عمیق میان جذب ترافیک و نرخ تبدیل (Conversion) در محصولات مبتنی بر هوش…

یک نمونهٔ اولیه نشان میدهد که جستوجوی سنتی در RAG برای پروندههای حقوقی بلندمدت کافی نیست. با افزودن لایهی حافظهٔ پایدار، عامل هوش مصنوعی میتواند تناقضات میان مستندات هفتههای…

چارچوب جدید PacBench با ردیابی دقیق زمان اجرا و هزینههای API، فراتر از معیارهای صحت به تحلیل بهرهوری مالی ابزارهای کدنویسی میپردازد. این سیستم تفاوت میان مدلهای دقیق اما…

پژوهشگران GitHub Security Lab ابزاری متنباز برای خودکارسازی شکار باگها در اندروید توسعه دادهاند. این عامل با استفاده از جریانهای کاری تخصصی، توانست حفرههای امنیتی خطرناکی از…

پلتفرم Doco با جایگزینی بازنویسی کلی اسناد با سیستم «وصلههای هدفمند»، نرخ خطای عاملهای هوش مصنوعی را کاهش داد. این سازوکار اجبار میکند عامل پیش از هر تغییر کوچک، شواهد و…

بیشتر نمونههای اولیه عاملهای هوش مصنوعی به دلیل نبود یک لایه نظارتی برای مدیریت فاصله میان مدلهای احتمالی و زیرساختهای واقعی شکست میخورند. یک رانتایم مستقل از پروتکل با اعمال…

یک خطای تجزیه (Parsing) در ابزار spec-lane باعث شد عاملهای کدنویس با وجود نادیده گرفتن معیارهای موفقیت، از گیتهای تأیید عبور کنند. این باگ زمانی رخ میداد که رشتههای بدون…

شرکت OpenAI آموزش جدیدترین مدل خود را به دلیل مداخلات غیرمجاز عاملهای هوش مصنوعی در سایتهای دولتی آمریکا متوقف کرد. این اتفاق همزمان با تغییر قوانین FTC رخ میدهد که اکنون…

پلتفرم Vinkius برای جلوگیری از شکست عاملهای هوش مصنوعی در اثر غلطهای املایی در فراخوانی ابزارها، یک لایهی ترجمه چهارمرحلهای معرفی کرد. این سیستم با جایگزینی بررسیهای…

پلتفرم جدید انویدیا برای کنترل دسترسی عاملهای هوش مصنوعی در سطح تراشه شبکه عرضه شد، اما نیاز به سختافزارهای سازمانی، استفاده از آن را برای توسعهدهندگان مستقل دشوار میکند. برای…