پرش به محتوای اصلی

موضوع

همراستاسازی

Alignment research, RLHF, Constitutional AI, safety training

۸۳۴ مقاله منتشر شده

چرا تکامل خودکار هوش مصنوعی، سیستم‌های نظارتی ما را نابود می‌کند؟

چرا تکامل خودکار هوش مصنوعی، سیستم‌های نظارتی ما را نابود می‌کند؟

جک کلارک، از بنیان‌گذاران Anthropic، هشدار می‌دهد که احتمال ۶۰ درصدی وجود دارد که هوش مصنوعی تا سال ۲۰۲۸ قادر به آموزش نسخه‌های بعدی خود باشد. این چرخه بازگشتی می‌تواند منجر به…

۳ دقیقه خواندن
چرا ترس از هوش مصنوعی، ابزار جدید میلیاردرها برای حذف رقباست؟

چرا ترس از هوش مصنوعی، ابزار جدید میلیاردرها برای حذف رقباست؟

تلاش حقوقی ایلان ماسک برای متوقف کردن ساختار سودآور OpenAI، پرده از تضاد عجیبی برداشت: استفاده از ترس‌های «آخرالزمانی» برای ضربه زدن به رقبا. این پرونده نشان می‌دهد چگونه بحث‌های…

۲ دقیقه خواندن
پرده‌برداری از حفره‌های امنیتی Mistral در برابر اخبار جعلی دولتی

پرده‌برداری از حفره‌های امنیتی Mistral در برابر اخبار جعلی دولتی

حسابرسی جدید NewsGuard نشان می‌دهد مدل Le Chat در برابر پروپاگاندای دولتی به‌شدت آسیب‌پذیر است. نرخ خطا در پاسخ به پرسش‌های گمراه‌کننده تا ۸۰ درصد افزایش می‌یابد که نشان‌دهنده‌ی…

۲ دقیقه خواندن
گزارش IBM: مدل ۸ میلیاردی Granite 4.1 مدل‌های ۳۲ میلیاردی MoE را شکست داد

گزارش IBM: مدل ۸ میلیاردی Granite 4.1 مدل‌های ۳۲ میلیاردی MoE را شکست داد

شرکت IBM با معرفی خانواده مدل‌های Granite 4.1 ثابت کرد که مهندسی دقیق داده می‌تواند جایگزین حجم عظیم پارامترها شود. مدل ۸ میلیارد پارامتری این مجموعه، با تکیه بر کیفیت داده،…

۳ دقیقه خواندن۱
پنج اصل سام آلتمن: نقشه راه OpenAI برای توجیه هزینه‌های نجومی محاسبات

پنج اصل سام آلتمن: نقشه راه OpenAI برای توجیه هزینه‌های نجومی محاسبات

سام آلتمن با معرفی پنج اصل راهبردی، تلاش می‌کند هزینه‌های کلان زیرساختی OpenAI را توجیه کند. این چارچوب با تأکید بر دموکراتیزه کردن، مسیر ادغام عمودی و خرید گسترده سخت‌افزار را…

۳ دقیقه خواندن۱
چرا تایید بی‌چون‌وچرای AI می‌تواند برای سلامت روان شما خطرناک باشد؟

چرا تایید بی‌چون‌وچرای AI می‌تواند برای سلامت روان شما خطرناک باشد؟

شرکت Anthropic با معرفی مدل‌های جدید، پدیده «تملق» یا تایید کورکورانه کاربر را در Opus 4.7 به شدت کاهش داد. این شرکت با استفاده از داده‌های مصنوعی، مانع از آن شد که هوش مصنوعی در…

۳ دقیقه خواندن