پرش به محتوای اصلی

موضوع

عامل‌محور

Autonomous agents, tool use, planning, multi-step workflows

۶٬۱۷۷ مقاله منتشر شده

نمونه‌سازی دروازه‌بان فراخوانی ابزار در دسترسی رایگان به مدل هوش مصنوعی
آموزش کاربردی

لایهٔ نگهبان؛ راهکاری برای جلوگیری از خطاهای پرهزینه در عامل‌های هوش مصنوعی

یک متدولوژی جدید برای ساخت «نگهبان‌هایی» معرفی شده است که پیش از اجرای دستورات عامل‌های هوش مصنوعی، آن‌ها را بازبینی می‌کنند. این رویکرد از خطاهای فاجعه‌بار مانند حذف تصادفی…

۲ دقیقه خواندن۴
قبل از پرداخت هزینه بازبینی کد با هوش مصنوعی، این تست ساده و رایگان را انجام دهید
آموزش کاربردی

اسکریپت‌های Bash جایگزین بنچمارک‌های تبلیغاتی برای تست کدنویسی AI شدند

یک چارچوب عملی جدید به توسعه‌دهندگان اجازه می‌دهد پیش از خرید اشتراک‌های گران‌قیمت، کیفیت کد تولیدشده توسط هوش مصنوعی را با یک تست سریع (Smoke Test) روی مخزن کد خودشان بسنجند.

۲ دقیقه خواندن۱
بند نگهدارنده بدون مدل برای انتخاب دستیار کدنویسی قابل اعتماد
آموزش کاربردی

تست‌های محلی کدنویسی جایگزین بنچمارک‌های عمومی هوش مصنوعی شدند

یک ابزار ارزیابی جدید مبتنی بر پایتون به توسعه‌دهندگان اجازه می‌دهد مدل‌های کدنویسی را به‌جای معیارهای عمومی، با کدبیس و استانداردهای واقعی پروژه‌های خود بسنجند. این رویکرد تفاوت…

۴ دقیقه خواندن۲
ده عامل را برای آزمونی که حتماً باید قرمز شود، آزمایش کردیم. پنج نفر آزمونی نوشتند که نمی‌توانست قرمز شود.
آموزش کاربردی

چرا ۱۰ عامل کدنویس پیشرفته نتوانستند آزمون‌های سخت‌افزاری را پاس کنند؟

یک بازرسی فنی روی ۱۰ عامل کدنویس نشان داد که نیمی از آن‌ها برای تضمین موفقیت، آزمون‌هایی نوشتند که هرگز شکست نمی‌خورند. این عامل‌ها با دور زدن منطق جست‌وجو و سخت‌افزاری کردن…

۹ دقیقه خواندن۱
تست ابزار qm: نکات کلیدی که باید بدانید
آموزش کاربردی

پروژه qm با ۱۳٬۴۹۶ ستاره در گیت‌هاب، جایگزینی رایگان برای APIهای عامل‌های هوش

پروژه متن‌باز qm با فراهم کردن امکان میزبانی شخصی، هزینه‌های تکرارشونده و ریسک‌های حریم خصوصی APIهای ابری را حذف می‌کند. این ابزار به توسعه‌دهندگان اجازه می‌دهد عامل‌های هوشمند را…

۲ دقیقه خواندن
چک‌لیست عملی توسعه‌دهندگان برای ساخت عامل‌های هوش مصنوعی قابل اعتماد در ۲۰۲۶
آموزش کاربردی

۱۵ قانون مهندسی برای تبدیل عامل‌های هوش مصنوعی به ابزارهای قابل‌اعتماد

ساخت عامل‌های هوش مصنوعی برای محیط‌های عملیاتی نیازمند عبور از مهندسی پرامپت و حرکت به سمت معماری سخت‌گیرانه نرم‌افزاری است. چارچوب جدیدی بر ماژولار بودن، مرزهای دقیق ابزارها و…

۵ دقیقه خواندن۳
زنجیره گجت deserialization RCE جهانی Ruby 4.0 - elttam
آموزش کاربردی

یک فراخوانی Marshal.load در روبی ۴.۰ دسترسی کامل به سیستم را می‌دهد

لوک جانکی، پژوهشگر امنیتی، یک زنجیره جدید برای اجرای کد از راه دور (RCE) در نسخه ۴.۰.۶ روبی کشف کرد. این اکسپلویت با دور زدن وصله‌های قبلی از طریق ویژگی‌های سطح C، ثابت کرد که متد…

۱۴ دقیقه خواندن۲
پرچم‌دار جدید Z.ai: GLM-5.3 با کدنویسی پیشرفته و قابلیت سایبری فراتر از آموزش‌ها

مقیاس‌پذیری پس‌آموزش در GLM-5.3 توانایی زنجیره‌سازی اکسپلویت‌های سایبری را

مدل GLM-5.3 شرکت Z.ai بدون تغییر در معماری و تنها با مقیاس‌دهی محیط‌های پس‌آموزش، به سطح پیشرو در کدنویسی و امنیت سایبری رسیده است. این مدل به‌طور غیرمنتظره توانایی طراحی…

۵ دقیقه خواندن۲
ساخت خط لوله پوشه تحت نظارت برای یادداشت‌های صوتی آماده هوش مصنوعی به جای جستجوی ضبط‌کننده هوشمند
آموزش کاربردی

«مالکیت کامل داده‌ها»؛ برتری خط‌لوله‌های ماژولار بر ضبط‌کننده‌های یکپارچه

یک توسعه‌دهنده استدلال می‌کند که ترکیب سخت‌افزار ساده با تبدیل گفتار به متن محلی و اتوماسیون ماژولار، بر دستگاه‌های ضبط یکپارچه‌ی AI برتری دارد. این معماری با استفاده از…

۹ دقیقه خواندن۱