
کدهای موفق HTTP ۲۰-۰۰ لایهٔ پنهانِ مسدود بودنِ دسترسیِ عاملهای هوش مصنوعی
یک توسعهدهنده کشف کرد که کدهای وضعیت HTTP 200 در محیطهای ابری اغلب فریبدهنده هستند و دسترسی واقعی عاملها را به APIها میپوشانند. برای حل این مشکل، یک متد اعتبارسنجی…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۶٬۲۱۹ مقاله منتشر شده

یک توسعهدهنده کشف کرد که کدهای وضعیت HTTP 200 در محیطهای ابری اغلب فریبدهنده هستند و دسترسی واقعی عاملها را به APIها میپوشانند. برای حل این مشکل، یک متد اعتبارسنجی…

یک افزونه غیررسمی اکنون امکان ثبت فراخوانیهای مدل زبانی و اجرای ابزارها در عامل Hermes را فراهم میکند. این ابزار با تبدیل تعاملات به دادههای OpenTelemetry، دید عمیقی از…

بهروزرسانی پسآموزش مدل V4 Flash نشان میدهد توانایی نوشتن کد با توانایی مدیریت یک ماشین متفاوت است. در حالی که نمرات کدنویسی تکمرحلهای تغییر نکرد، عملکرد مدل در حلقههای…

انتقال فراخوانی ابزارها از محیط دمو به تولید، نیازمند نگاه به مدل زبانی بهعنوان یک کاربر غیرقابلاعتماد است. این راهنما چارچوبی سختگیرانه برای اعتبارسنجی زمان اجرا و کلیدهای…

ابزار جدید jitpass رمزهای متنی توسعهدهندگان را به یک خزانه رمزگذاریشده منتقل میکند که تنها با Touch ID باز میشود. این سیستم با تزریق رمزها به حافظه تنها پس از تأیید بیومتریک،…

بسیاری از کاربران متوجه شدهاند که مدلهای محلی با پنجرهٔ متنی گسترده، برخلاف ادعاهای سازنده، در حدود ۳۳ هزار توکن دچار فروپاشی میشوند. علت این مشکل نه در خودِ مدل، بلکه در…

یک چارچوب جدید برای تیمهای عصر هوش مصنوعی، هفت روش متمایز برای اشتراکگذاری ابزارها را تعریف کرده است. مهمترین تغییر، گذار از APIهای انسانمحور به رابطهای عاملمحور است که در…

انتخاب قراردادهای API سازگار با OpenAI بهجای قراردادهای اختصاصی هر ارائهدهنده، هزینه عملیاتی تعویض مدل در محیط تولید را بهشدت میکاهد. این رویکرد برای توسعهدهندگان باتهای…

شرکت Artificial Analysis ابزار Optima را برای تست مدلهای هوش مصنوعی بر اساس دادههای اختصاصی و گردشکارهای واقعی سازمانها معرفی کرد. این پلتفرم تمرکز ارزیابی را از جدولهای…

ابزار ProofRun با پیوند دادن نتایج تست به اثر انگشت کد، مانع از توهم عاملهای هوش مصنوعی دربارهی موفقیت تستها میشود. این سیستم محلی، هرگونه ادعای «تستها پاس شدند» را با وضعیت…

یک پیادهسازی جدید با استفاده از مدلهای بینایی Oxlo.ai، تصاویر داشبوردهای گرافانا را با لاگهای خام تطبیق میدهد تا علت حوادث فنی را تشخیص دهد. این سیستم با تولید تحلیلهای…

یک چارچوب جدید برای خلاصهسازی ایمیلها و جلسات در حوزه سلامت، اولویت را از روانی متن به دقت دادهای و مرزهای سخت امنیتی تغییر داده است. این رویکرد با تبدیل خلاصهسازی به یک…