پرش به محتوای اصلی

موضوع

عامل‌محور

Autonomous agents, tool use, planning, multi-step workflows

۶٬۲۲۰ مقاله منتشر شده

برنامه‌ریز هر بار ۳ اشتباه یکسان را تکرار کرد. مدل بزرگ‌تر مشکل را حل نکرد.
آموزش کاربردی

پارامترهای بیشتر در برابر اعتبارسنجی قطعی برای تضمین اجرای برنامه‌ها

آزمون‌های میدانی روی موتور PlannerCritic نشان می‌دهد که مدل‌های بزرگ‌تر همچنان در منطق وابستگی‌ها شکست می‌خورند. برای تضمین اجرای برنامه‌ها، جایگزینی پارامترهای بیشتر با…

۵ دقیقه خواندن۴
بررسی عملکرد عامل GlobalCart: مسیریابی، هزینه‌ها و نقاط ضعف
آموزش کاربردی

مسیریابی قطعی در GlobalCart هزینهٔ عامل‌های هوش مصنوعی را دو رقمی کاهش داد

شرکت GlobalCart نشان داد که استفاده از قوانین سخت‌افزاری برای تیکت‌های پرتکرار، بسیار به‌صرفه‌تر از تکیه بر استدلال مدل‌های زبانی است. این شرکت دریافت که «حلقه‌های خاموش» و ابهام…

۴ دقیقه خواندن۲
دو GPU با vLLM برای درک صفحه نمایش و تعیین مختصات در عامل‌های دسکتاپ (Neo نسخه ۰.۱)
آموزش کاربردی

LuxurAI با موتور vLLM دوگانه دقتِ درک صفحه را در عامل‌های دسکتاپ ارتقا داد

سیستم Neo v0.1 با جایگزینی تولید فایل‌های یکپارچه با کامپایل بلوکی، خطاهای ساختاری در رابط‌های کاربری را حذف کرد. این عامل دسکتاپ از یک موتور بینایی دوگانه برای مبنی‌سازی دقیق…

۱ دقیقه خواندن۱
اگر سرور MCP شما از OAuth استفاده می‌کند، هر پوشه فکر می‌کند هیچ ابزاری ندارد
آموزش کاربردی

دیوارهای احرازی OAuth سرورهای MCP را در دایرکتوری‌ها نامرئی می‌کنند

سرورهای راه دور MCP که از OAuth استفاده می‌کنند، به‌دلیل عدم توانایی خزنده‌های دایرکتوری در عبور از سد احراز هویت، بدون ابزار نمایش داده می‌شوند. راهکار این مشکل، جداسازی متدهای…

۵ دقیقه خواندن
عامل هوش مصنوعی در حال کار روی کامپیوتر با نماد خطا و ابزار تعمیر
آموزش کاربردی

مهندسی شاسی؛ جایگزینی زیرساخت‌های سخت‌گیرانه با مهندسی پرامپت در عامل‌های هوش

شکست بسیاری از عامل‌های هوش مصنوعی نه به دلیل ضعف مدل، بلکه به دلیل نبود زیرساخت‌های حمایتی است. رویکرد «مهندسی شاسی» با تمرکز بر پایداری وضعیت و تأیید سخت‌گیرانه، تولیدکننده‌های…

۲ دقیقه خواندن۲
آزمایشگاه‌های هوش مصنوعی هنوز درباره مهار مدل‌های فرار سکوت کرده‌اند

OpenAI در برابر Meta و Anthropic؛ شکاف در شفافیت پروتکل‌های توقف

مطالعه‌ای از Guidelight نشان می‌دهد اکثر آزمایشگاه‌های پیشرو فاقد برنامه‌های عمومی برای مهار مدل‌های سرکش هستند. OpenAI به دلیل پاسخ‌های عملی در حوادث گذشته بالاترین امتیاز را کسب…

۸ دقیقه خواندن۴
عامل جمع‌آوری داده خودترمیم که راه‌حل تأییدنشده ارائه نمی‌دهد
آموزش کاربردی

Patchwright با سندباکس‌های داده‌ای ثابت نرخ خطای اسکرپرهای AI را کاهش داد

ابزار جدید Patchwright با استفاده از داده‌های تغییرناپذیر، کدهای خراب اسکرپرهای وب را به‌طور خودکار تعمیر و اعتبارسنجی می‌کند. این سامانه با به‌کارگیری یک مدل بازبینی مستقل، شکاف…

۶ دقیقه خواندن۴