پرش به محتوای اصلی

موضوع

عامل‌محور

Autonomous agents, tool use, planning, multi-step workflows

۳٬۵۳۵ مقاله منتشر شده

AI

چرا جستجوی شغل در آمریکا از این پس در محیط ChatGPT اتفاق می‌افتد؟

اوپن‌ای‌آی با ادغام لیست‌های شغلی زنده و ویرایشگر رزومه، ChatGPT را به یک پلتفرم جامع برای مدیریت مسیر شغلی تبدیل کرد. این به‌روزرسانی، ابزاری که پیش‌تر فقط برای پیش‌نویس متن بود…

۲ دقیقه خواندن
AI

چرا جایگزینی پشتیبانی انسانی با هوش مصنوعی در متا یک کابوس امنیتی شد؟

هکرهای حرفه‌ای با سوءاستفاده از یک نقص امنیتی در چت‌بات پشتیبانی متا، حساب‌های سطح بالای اینستاگرام از جمله صفحه کاخ سفید اوباما را سرقت کردند. این حمله با دور زدن احراز هویت دو…

۲ دقیقه خواندن
AI

رشد ۳ برابری کاربران غیربرنامه‌نویس در Codex: چرخش OpenAI به سمت بازار تجاری

OpenAI در حال تبدیل Codex از یک ابزار تخصصی کدنویسی به اپلیکیشن بهره‌وری برای متخصصان کسب‌وکار است. جذب کاربران غیربرنامه‌نویس با سرعتی سه برابر بیشتر از توسعه‌دهندگان، مسیر این…

۲ دقیقه خواندن
AI
آموزش کاربردی

RubricMiddleware لنگ‌چین: عبور از پرامپت‌نویسی به سمت تضمین کیفیت خودکار

لنگ‌چین ابزار RubricMiddleware را معرفی کرد تا عامل‌های هوش مصنوعی بتوانند خروجی‌های خود را بر اساس معیارهای مشخص اصلاح کنند. در این سیستم، یک عامل ارزیاب با استفاده از ابزارهای…

۲ دقیقه خواندن
AI

بنچمارک CVE-Bench: نرخ موفقیت GPT-5.5 در رفع آسیب‌پذیری‌های امنیتی ۵۰٪ است

مدل‌های پیشرو همچنان در رفع نیمی از آسیب‌پذیری‌های امنیتی واقعی ناتوان‌اند. بنچمارک CVE-Bench نشان می‌دهد که «استدلال امنیتی» در این مدل‌ها بیشتر شبیه به تطبیق الگو است تا تحلیل…

۲ دقیقه خواندن
AI

چگونه «هارنس» یا محیط ارزیابی، توانایی واقعی مدل‌های پیشرو را بازتعریف می‌کند؟

شرکت OpenAI در یک دستورالعمل فنی استدلال می‌کند که توانایی مدل‌های پیشرو یک مقدار ثابت نیست، بلکه متغیری وابسته به «هارنس» (Harness) یا همان محیط، ابزارها و بودجه محاسباتی است.…

۳ دقیقه خواندن
AI

درون استراتژی Mistral برای مالکیت کامل زنجیره تأمین هوش مصنوعی اروپا

شرکت Mistral AI از یک آزمایشگاه مدل‌سازی به ارائه‌دهنده کامل زیرساخت، پلتفرم و مشاوره تبدیل شده است. این شرکت با راه‌اندازی مرکز داده اختصاصی در پاریس، بر استقرار محلی و مدل‌های…

۲ دقیقه خواندن
AI

CogCAPTCHA30 و شکاف فرآیندی: چرا مدل‌های پیشرو در استدلال کمتر شبیه انسان هستند؟

پژوهشی جدید با معرفی «تست تورینگ فرآیندی» نشان می‌دهد که مدل‌های پیشرو با وجود ارائه پاسخ‌های صحیح، مسیری کاملاً متفاوت از انسان برای رسیدن به جواب طی می‌کنند. این مطالعه فاش…

۳ دقیقه خواندن