پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۰۹۶ مقاله منتشر شده

نمونه دادگاه هوش مصنوعی در مخزن protolink
آموزش کاربردی

پروژه‌ی ProtoLink: تغییر رای دادگاه AI بر اساس توپولوژی ارتباطات

پروژه‌ی ProtoLink نشان می‌دهد که نحوه اتصال عامل‌های هوش مصنوعی به یکدیگر، فارغ از قدرت مدل، می‌تواند نتیجه‌ی تصمیمات آن‌ها را از «بی‌گناه» به «گناهکار» تغییر دهد. این آزمایش با…

۱۰ دقیقه خواندن۳
عکس: دو ربات در حال گفتگو، نمادی از تعامل عامل‌های هوش مصنوعی و فلسفه آن‌ها
آموزش کاربردی

چرا فایل‌های فلسفی در مدیریت رفتار مدل‌ها مؤثرتر از Guardrails هستند؟

یک رویکرد جدید در ارکستراسیون عامل‌ها پیشنهاد می‌کند که به جای لیست‌های طولانی از ممنوعیت‌ها، از یک فایل «فلسفه» برای هدایت رفتار مدل استفاده شود. در این روش، رفتار عامل از طریق…

۷ دقیقه خواندن
نحوه مسیریابی کارهای هوش مصنوعی بین مدل‌های باز و مرزی
آموزش کاربردی

۵ پرسش کلیدی برای توزیع وظایف بین مدل‌های وزن‌باز و پیشرو

معماری بهینه هوش مصنوعی نیازمند تبدیل انتخاب مدل از یک تصمیم برندمحور به یک مسئله مسیریابی است. کسب‌وکارها با توزیع وظایف بین مدل‌های وزن‌باز برای حریم خصوصی و مدل‌های پیشرو برای…

۶ دقیقه خواندن
پایگاه داده عمومی تئوری‌ها برای ریاضیات ماشینی
آموزش کاربردی

TheoremDB: تبدیل تلاش‌های شکست‌خورده به پایگاه دادهٔ اثبات‌های تأییدشده

پلتفرم TheoremDB با ایجاد یک فضای کاری مشترک، از تکرار تلاش‌های شکست‌خورده توسط عامل‌های هوش مصنوعی در ریاضیات جلوگیری می‌کند. این سامانه نتایج را به اثبات‌های تأییدشده در Lean…

۱۷ دقیقه خواندن
ساخت ScamLens AI: کاوش من در هوش مصنوعی برای تشخیص فیشینگ و مهندسی اجتماعی
آموزش کاربردی

«توضیح مهندسی اجتماعی»؛ راهکار جدید ScamLens برای مقابله با کلاهبرداری

زین نوفان ابوزید، توسعه‌دهنده اردنی، با معرفی ScamLens AI رویکردی جدید برای شناسایی فیشینگ ارائه داده است. این سیستم به‌جای ارائه امتیاز ریسک مبهم، محرک‌های روان‌شناختی و…

۵ دقیقه خواندن
حلقه خودکار اشکال‌زدایی در هوش مصنوعی خودترمیم‌شونده
آموزش کاربردی

«سیستم ایمنی جمعی»؛ راهکار TormentNexus برای حذف باگ‌های تکراری

یک معماری جدید خودبهبودبخش، عیب‌یابی واکنشی را با حلقه‌های خودمختار جایگزین کرده است که خطاها را در لحظه تشخیص داده و اصلاح می‌کنند. این سیستم با ذخیره راهکارها در یک حافظه مشترک،…

۵ دقیقه خواندن۱
«همان پاسخ‌های ثابت را ۱۵ بار قضاوت کردیم. قاضی بخش پرنویز نبود.»
آموزش کاربردی

«ضعف در دستورالعمل‌ها»؛ علت اصلی نوسان عملکرد عامل‌های هوش مصنوعی

پژوهشی از AgentVitals نشان می‌دهد نوسان در عملکرد عامل‌های هوش مصنوعی بیش از آنکه به ناپایداری مدل مربوط باشد، ناشی از ابهام در دستورالعمل‌های داوری است. این تیم دریافت که طراحی…

۵ دقیقه خواندن
دمای مدل، خلاقیت نمی‌آورد
آموزش کاربردی

تنظیمات Temperature در مدل‌های زبانی ابزاری برای خلاقیت نیستند

تغییر دمای مدل‌های زبانی (Temperature) باعث تولید ایده‌های جدید نمی‌شود، بلکه تنها احتمال انتخاب توکن‌های کم‌احتمال‌تر را افزایش می‌دهد. این تنظیمات رتبه‌بندی داخلی مدل را تغییر…

۹ دقیقه خواندن۲
چارچوب پایتونی NOOA انویدیا: تبدیل عامل هوش مصنوعی به یک کلاس پایتون
آموزش کاربردی

فریم‌ورک NOOA انویدیا: تبدیل عامل‌های هوش مصنوعی به کلاس‌های پایتون

انویدیا با معرفی NOOA، پیچیدگی‌های توسعه عامل‌های هوش مصنوعی را به ساختار استاندارد مهندسی نرم‌افزار منتقل کرد. این ابزار با کاهش ۵۰ درصدی مصرف توکن، دقت بالایی را در بنچمارک‌های…

۵ دقیقه خواندن
مقایسه عملکرد GPT-4o، Claude و Mistral در وظایف واقعی تولیدی
آموزش کاربردی

تضاد بنچمارک‌های عمومی و عملکرد واقعی؛ چرا مدل‌های برتر در تولید شکست می‌خورند؟

رتبه‌بندی‌های عمومی مدل‌های زبانی اغلب برای توسعه‌دهندگان گمراه‌کننده است، زیرا نمرات آکادمیک محدودیت‌های دنیای واقعی را پوشش نمی‌دهند. رویکرد مسیریابی وظایف (Task-specific…

۳ دقیقه خواندن۱