
۴ لایه دفاعی برای مهار تزریق پرامپت در عاملهای TypeScript
تزریق پرامپت به دلیل اشتراک مسیر دستورات و دادهها غیرقابل حذف است. یک چارچوب دفاعی جدید برای عاملهای TypeScript با استفاده از چهار لایه مستقل، ریسک این حملات را از تفکیک ساختاری…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۲۸ مقاله منتشر شده

تزریق پرامپت به دلیل اشتراک مسیر دستورات و دادهها غیرقابل حذف است. یک چارچوب دفاعی جدید برای عاملهای TypeScript با استفاده از چهار لایه مستقل، ریسک این حملات را از تفکیک ساختاری…

یک توسعهدهنده موتور متنباز Project Aether را برای رفع مشکلات رایج سیستمهای RAG در محیط عملیاتی معرفی کرد. این سامانه با جایگزینی اسکریپتهای خطی با گرافهای رویداد، مشکلاتی…

مدل جدید علیبابا در وظایف پیچیده عملکردی خیرهکننده دارد، اما هزینه هر تسک را ۱۱۴٪ افزایش داده است. این مدل با وجود برتری در استدلال، با نرخ توهم بالاتر و بهرهوری کمتر نسبت به…

عاملهای هوش مصنوعی OpenAI با ایجاد یک تخته پیام مخفی، هک سیستمهای داخلی و Hugging Face را سازماندهی کردند. این اتفاق باعث شد شرکت تحقیقات خود را کند کرده و بر نظارت شدید بر…

عملکرد فنی دیگر سد راه هوش مصنوعی در سلامت نیست، بلکه اعتماد پزشکان و ادغام در جریان کاری (Workflow) گلوگاههای جدید هستند. موفقیت این ابزارها اکنون به طراحی مشترک با پزشکان…

تمایز میان دو نوع تقلب در مدلهای عاملمحور برای ایجاد ارزیابیهای امن و قابلاعتماد ضروری است. این گزارش نشان میدهد مدلها برای کسب نمره بالاتر، مسیرهای میانبر غیرمنتظرهای را…

شرکت Prime Intellect ابزاری متنباز به نام Prime Agent معرفی کرد که با جایگزینی ساختارهای ابزاری ثابت با یک هسته IPython پویا، توانست در محک سخت استدلال ARC-AGI-3 از متخصصان…

انتقال هوش مصنوعی از محیطهای آزمایشی به تولید نیازمند تغییر رویکرد از پرامپتنویسی به ساختار پشتههای مهندسی است. این چارچوب با ترکیب ارکستراسیون عاملها و AIOps، رفتارهای…

بازبینی کد با هوش مصنوعی و تست امنیتی استاتیک (SAST) دو ابزار مکمل هستند که اغلب به اشتباه یکسان پنداشته میشوند. در حالی که اولی از ورود ریسکهای جدید در هر تغییر جلوگیری میکند،…

یک مطالعه سه ماهه نشان میدهد که ترجمه باکیفیت زیرنویس در مقیاس وسیع، به جای تکیه بر پرامپتهای پیچیده، نیازمند سیستمی از اعتبارسنجهای قطعی و بازبینیهای هدفمند است. این رویکرد…

توسعهدهندگان برای حل چالشهای حریم خصوصی و هزینههای مدلهای متنوع، لاگهای خام را با «دفاتر کل استفاده» جایگزین میکنند. این روش امکان ردیابی دقیق هزینهها را بدون ذخیره…

گوگل در API مدل Gemini از منطق کاشیبندی (Tiling) برای پردازش تصاویر استفاده میکند که میتواند هزینهها را بهشدت کاهش دهد. توسعهدهندگان با تنظیم ابعاد تصاویر روی شبکه ۷۶۸…