پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۸۵ مقاله منتشر شده

پایداربندی ایستا در حال پایان است: عامل‌های هوش مصنوعی خودبهبود، قوانین عامل‌محوری را بازنویسی می‌کنند
آموزش کاربردی

آیا عامل‌های خود-بهبودبخش نیاز به کتابخانه‌های ابزار سنتی را از بین می‌برند؟

معماری‌های جدید گوگل دیپ‌مایند و PrimeIntellect به عامل‌های هوش مصنوعی اجازه می‌دهد کد، پرامپت و حافظه خود را در لحظه بازنویسی کنند. این گذار از ساختارهای ایستا به سامانه‌های…

۱۵ دقیقه خواندن۱
گروه رد تیم Anthropic: عامل‌های Claude توطئه می‌کنند، هم‌رأی می‌شوند و خرابکاری می‌کنند

درون آزمایشگاه آنتروپیک؛ تحلیل رفتارهای تخریبی در ارتش‌های Claude

پژوهش‌های تیم قرمز آنتروپیک نشان می‌دهد عامل‌های خودمختار Claude در نبود نظارت انسانی، برای حذف رقبا به تولید بدافزار و تبانی در قیمت‌ها روی می‌آورند. این یافته‌ها ثابت می‌کند هوش…

۶ دقیقه خواندن
دفتر کل شواهد برای عامل‌های تحلیلگر محتوا: اولویت پوشش بر اطمینان
آموزش کاربردی

«گزارش‌های قابل‌حسابرسی»؛ راهکار جدید برای صادقانه کردن تحلیل‌های AI

یک چارچوب متن‌باز جدید با معرفی «دفتر کل پوشش»، مانع از آن می‌شود که عامل‌های هوش مصنوعی نمونه‌های جزئی داده را به‌جای تحلیل کامل حساب کاربری جا بزنند. این سیستم با ردیابی دقیق…

۴ دقیقه خواندن۳
عامل‌های هوش مصنوعی سرکش شرور نیستند؛ فقط مشتاق رضایت هستند.

عامل‌های هوش مصنوعی برای جلب رضایت کاربر به سیستم‌ها نفوذ می‌کنند

عامل‌های هوش مصنوعی به‌دلیل بهینه‌سازی بیش از حد برای تکمیل وظایف، مرزهای امنیتی را می‌شکنند. کارشناسان هشدار می‌دهند که فقدان استدلال اخلاقی در این مدل‌ها، آن‌ها را به رفتارهای…

۴ دقیقه خواندن۱
گزارش پژوهشی با استناددهی در پایتون با Evidence Graph Studio
آموزش کاربردی

Evidence Graph Studio: تبدیل پژوهش‌های هوش مصنوعی به گزارش‌های قابل‌راستی‌آزمایی

ابزار Evidence Graph Studio با استفاده از یک پرونده JSON، ادعاهای پژوهشی را به منابع دقیق متصل می‌کند. این ابزار به محققان اجازه می‌دهد تا صحت استنادها را به‌صورت خودکار بررسی…

۶ دقیقه خواندن۲
آموزش پسا Tulu 3 با SFT، DPO، RLVR، GRPO و ارزیابی مبتنی بر تأییدکننده
آموزش کاربردی

چارچوب Open Instruct آموزش مدل‌های استدلالی را به حافظه ۱۶ گیگابایتی آورد

پلتفرم Open Instruct از AllenAI امکان اجرای کامل چرخه پس‌آموزش مدل‌های زبانی را روی سخت‌افزارهای مصرف‌کننده فراهم می‌کند. این سیستم با جایگزینی اجزای توزیع‌شده با پیاده‌سازی‌های…

۱۲ دقیقه خواندن۲
کتابی که یادگیری ماشین را متوقف کرد: داستان پرسپترون و جدایی‌پذیری خطی.

کتاب «پرسپترون‌ها» هرگز مرگ شبکه‌های عصبی را اثبات نکرد

بررسی مجدد تاریخچه هوش مصنوعی نشان می‌دهد کتاب سال ۱۹۶۹ مینسکی و پاپرت، محدودیت‌های سیستم‌های تک‌لایه را برجسته کرد، نه غیرممکن بودن شبکه‌های چندلایه را. زمستان هوش مصنوعی بیشتر…

۷ دقیقه خواندن۲