
پروژهی ProtoLink: تغییر رای دادگاه AI بر اساس توپولوژی ارتباطات
پروژهی ProtoLink نشان میدهد که نحوه اتصال عاملهای هوش مصنوعی به یکدیگر، فارغ از قدرت مدل، میتواند نتیجهی تصمیمات آنها را از «بیگناه» به «گناهکار» تغییر دهد. این آزمایش با…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۰۹۶ مقاله منتشر شده

پروژهی ProtoLink نشان میدهد که نحوه اتصال عاملهای هوش مصنوعی به یکدیگر، فارغ از قدرت مدل، میتواند نتیجهی تصمیمات آنها را از «بیگناه» به «گناهکار» تغییر دهد. این آزمایش با…

یک رویکرد جدید در ارکستراسیون عاملها پیشنهاد میکند که به جای لیستهای طولانی از ممنوعیتها، از یک فایل «فلسفه» برای هدایت رفتار مدل استفاده شود. در این روش، رفتار عامل از طریق…

گوگل دیپمایند با تبدیل مدل Gemma 4 به یک مدل انتشار (Diffusion)، سرعت تولید متن را به شدت افزایش داد. این معماری جدید برخلاف مدلهای رایج، اجازه میدهد مدل پیش از نهایی کردن…

معماری بهینه هوش مصنوعی نیازمند تبدیل انتخاب مدل از یک تصمیم برندمحور به یک مسئله مسیریابی است. کسبوکارها با توزیع وظایف بین مدلهای وزنباز برای حریم خصوصی و مدلهای پیشرو برای…

پلتفرم TheoremDB با ایجاد یک فضای کاری مشترک، از تکرار تلاشهای شکستخورده توسط عاملهای هوش مصنوعی در ریاضیات جلوگیری میکند. این سامانه نتایج را به اثباتهای تأییدشده در Lean…

یک محک جدید نشان میدهد چارچوب سبک mini-swe-agent در کارهای عیبیابی از Codex CLI پیشی گرفته است. این نتایج ثابت میکند ساختارهای سادهتر و خطی برای رفع باگهای واقعی کارآمدتر…

زین نوفان ابوزید، توسعهدهنده اردنی، با معرفی ScamLens AI رویکردی جدید برای شناسایی فیشینگ ارائه داده است. این سیستم بهجای ارائه امتیاز ریسک مبهم، محرکهای روانشناختی و…

یک معماری جدید خودبهبودبخش، عیبیابی واکنشی را با حلقههای خودمختار جایگزین کرده است که خطاها را در لحظه تشخیص داده و اصلاح میکنند. این سیستم با ذخیره راهکارها در یک حافظه مشترک،…

پژوهشی از AgentVitals نشان میدهد نوسان در عملکرد عاملهای هوش مصنوعی بیش از آنکه به ناپایداری مدل مربوط باشد، ناشی از ابهام در دستورالعملهای داوری است. این تیم دریافت که طراحی…

تغییر دمای مدلهای زبانی (Temperature) باعث تولید ایدههای جدید نمیشود، بلکه تنها احتمال انتخاب توکنهای کماحتمالتر را افزایش میدهد. این تنظیمات رتبهبندی داخلی مدل را تغییر…

انویدیا با معرفی NOOA، پیچیدگیهای توسعه عاملهای هوش مصنوعی را به ساختار استاندارد مهندسی نرمافزار منتقل کرد. این ابزار با کاهش ۵۰ درصدی مصرف توکن، دقت بالایی را در بنچمارکهای…

رتبهبندیهای عمومی مدلهای زبانی اغلب برای توسعهدهندگان گمراهکننده است، زیرا نمرات آکادمیک محدودیتهای دنیای واقعی را پوشش نمیدهند. رویکرد مسیریابی وظایف (Task-specific…