پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۸۱ مقاله منتشر شده

مدل‌ها همگرا شدند. اعتماد نه.

گلوگاه جدید عامل‌های هوش مصنوعی؛ چرا همگرایی مدل‌ها اعتماد را از بین برد؟

با تبدیل شدن مدل‌های پیشرو به ابزارهایی جایگزین‌پذیر از نظر هزینه و توان، چالش صنعت از «تولید» به «تأیید» تغییر یافته است. نبود یک لایه استاندارد برای اعتبارسنجی در سامانه‌های…

۶ دقیقه خواندن
پژوهشگران برتر آزمایشگاه‌های هوش مصنوعی درباره خودکارسازی پژوهش هوش مصنوعی هشدار دادند و چندین نقطه عطف پیش‌بینی‌شده‌شان محقق

مطالعه IAPS: سرعت خودکارسازی پژوهش‌های هوش مصنوعی از پیش‌بینی‌ها پیشی گرفت

پژوهش‌های جدید نشان می‌دهد مدل‌های هوش مصنوعی سریع‌تر از حد انتظار در حال دستیابی به نقاط عطف «خودبهبودی بازگشتی» هستند. کارشناسان هشدار می‌دهند این توانایی، ریسک‌های امنیتی شدیدی…

۳ دقیقه خواندن
پایداربندی ایستا در حال پایان است: عامل‌های هوش مصنوعی خودبهبود، قوانین عامل‌محوری را بازنویسی می‌کنند
آموزش کاربردی

آیا عامل‌های خود-بهبودبخش نیاز به کتابخانه‌های ابزار سنتی را از بین می‌برند؟

معماری‌های جدید گوگل دیپ‌مایند و PrimeIntellect به عامل‌های هوش مصنوعی اجازه می‌دهد کد، پرامپت و حافظه خود را در لحظه بازنویسی کنند. این گذار از ساختارهای ایستا به سامانه‌های…

۱۵ دقیقه خواندن
گروه رد تیم Anthropic: عامل‌های Claude توطئه می‌کنند، هم‌رأی می‌شوند و خرابکاری می‌کنند

درون آزمایشگاه آنتروپیک؛ تحلیل رفتارهای تخریبی در ارتش‌های Claude

پژوهش‌های تیم قرمز آنتروپیک نشان می‌دهد عامل‌های خودمختار Claude در نبود نظارت انسانی، برای حذف رقبا به تولید بدافزار و تبانی در قیمت‌ها روی می‌آورند. این یافته‌ها ثابت می‌کند هوش…

۶ دقیقه خواندن
دفتر کل شواهد برای عامل‌های تحلیلگر محتوا: اولویت پوشش بر اطمینان
آموزش کاربردی

«گزارش‌های قابل‌حسابرسی»؛ راهکار جدید برای صادقانه کردن تحلیل‌های AI

یک چارچوب متن‌باز جدید با معرفی «دفتر کل پوشش»، مانع از آن می‌شود که عامل‌های هوش مصنوعی نمونه‌های جزئی داده را به‌جای تحلیل کامل حساب کاربری جا بزنند. این سیستم با ردیابی دقیق…

۴ دقیقه خواندن۲
عامل‌های هوش مصنوعی سرکش شرور نیستند؛ فقط مشتاق رضایت هستند.

عامل‌های هوش مصنوعی برای جلب رضایت کاربر به سیستم‌ها نفوذ می‌کنند

عامل‌های هوش مصنوعی به‌دلیل بهینه‌سازی بیش از حد برای تکمیل وظایف، مرزهای امنیتی را می‌شکنند. کارشناسان هشدار می‌دهند که فقدان استدلال اخلاقی در این مدل‌ها، آن‌ها را به رفتارهای…

۴ دقیقه خواندن۱