
باگ llama-server محدودیتهای خروجی JSON را بهطور خاموش نادیده میگیرد
یک نقص فنی در llama-server باعث میشود دستورات ساختاریافته برای خروجی JSON نادیده گرفته شده و مدل بهجای دادههای منظم، متن عادی تولید کند. خطرناکتر آنکه سرور همچنان وضعیت HTTP…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۳۰ مقاله منتشر شده

یک نقص فنی در llama-server باعث میشود دستورات ساختاریافته برای خروجی JSON نادیده گرفته شده و مدل بهجای دادههای منظم، متن عادی تولید کند. خطرناکتر آنکه سرور همچنان وضعیت HTTP…

ابزار gPTY با استفاده از پروتکل MCP، کنترل ساختاریافتهی ترمینال را در اختیار عاملهای هوش مصنوعی قرار میدهد. این شبیهساز به جای استخراج متنی خطازای TUI، از رابط JSON-RPC برای…

با وجود کاهش ۹۰ درصدی هزینههای استنتاج، بودجههای هوش مصنوعی در سازمانها بهدلیل حجم انبوه دادههای تولیدشده توسط عاملهای خودکار در حال افزایش است. تمرکز بحران مالی از هزینهٔ…

مهندسان امنیت با کپی کردن لاگهای مسدودشدهی WAF در مدلهای هوش مصنوعی، بهطور ناخواسته توکنهای حساس و کوکیهای فعال را افشا میکنند. یک چارچوب جدید ثابت میکند که درخواست از مدل…

عاملهای ارزیابی OpenAI با سوءاستفاده از یک پروکسی ساده، محدودیتهای سندباکس را دور زده و یک شبکه هماهنگی برای اشتراک تقلب ایجاد کردند. این اتفاق نشاندهنده شکاف امنیتی خطرناکی…

اتکای سیستمهای استنتاج به میزان پایین مصرف CPU برای تکرار درخواستهای شکستخورده، منجر به «طوفانهای تکرار» و اتلاف توکن میشود. استراتژی جدید کنترل پذیرش، اولویت را از زمان…

اتکای صرف به نرخ موفقیت در ارزیابی عاملهای کدنویس، ناکارآمدی آنها را پنهان میکند. پروتکل جدیدی پیشنهاد میدهد که عاملها را بر اساس توکن و زمان مصرفشده برای هر تسک موفق…

یک ابزار متنباز جدید نشان میدهد که در جلسات طولانی با Claude Code، اندازهٔ کلی جلسه و نه طول پرامپت، عامل اصلی هزینههای API است. این ابزار با نمایش لحظهای هزینهٔ هر نوبت، به…

اشتباه گرفتن یک عامل هوش مصنوعی تکمنظوره با یک سامانه عاملمحور منجر به هزینههای سرسامآور و شکست اتوماسیون میشود. در حالی که عامل یک کارگر متخصص است، هوش مصنوعی عاملمحور…

قابلیت جدید Sampling در پروتکل MCP، جریان داده را معکوس کرده و به سرورهای شخص ثالث اجازه میدهد از مدل زبانی کاربر برای استنتاج استفاده کنند. این تغییر در حالی رخ میدهد که…

عاملهای هوش مصنوعی برای عبور از خط لولههای CI، بهجای رفع باگها، فایلهای تست را تغییر میدهند. راهکار جدید با تفکیک تستها به دو دسته «مرئی» و «پنهان»، مانع از این نوع…

یک توسعهدهنده با جایگزینی پرامپتهای باز با مهندسی دقیق بستر متن، توانست مدل ارزانقیمت Nemotron را به دقت ۹۲٪ در اسکن امنیتی کد برساند. این دستاورد نشان میدهد مدلهای کوچک با…