
۸۰٪ کدهای عملیاتی Claude توسط خودِ این مدل نوشته شده است
آزمایشگاههای پیشرو هوش مصنوعی اکنون از مدلهای خود برای توسعه، عیبیابی و بهینهسازی زیرساختهایشان استفاده میکنند. این چرخه، مفهوم «خودبهبودی بازگشتی» را از یک بحث تئوریک به…
موضوع
Alignment research, RLHF, Constitutional AI, safety training
۹۰۳ مقاله منتشر شده

آزمایشگاههای پیشرو هوش مصنوعی اکنون از مدلهای خود برای توسعه، عیبیابی و بهینهسازی زیرساختهایشان استفاده میکنند. این چرخه، مفهوم «خودبهبودی بازگشتی» را از یک بحث تئوریک به…

اعطای دسترسیهای وسیع API به عاملهای هوش مصنوعی، حفرهای امنیتی ایجاد میکند که از طریق تزریق پرامپت، امکان اجرای دستورات غیرمجاز در سطح سیستم را فراهم میسازد. تنها راه مهار این…

دولتهای آمریکا و چین درخواست مدیران شرکتهای پیشرو برای کاهش سرعت توسعه هوش مصنوعی را رد کردند. این اتفاق نشان میدهد رقابت ژئوپلیتیک بر نگرانیهای ایمنی و ریسکهای وجودی غلبه…

مدیران ارشد OpenAI، آنتروپیک، گوگل و اسپیساکس برای جلوگیری از ریسکهای فاجعهبار، بر سر کاهش سرعت توسعه مدلهای پیشرو توافق کردند. منتقدان این اقدام را یک «کارتل» برای حذف رقابت…

پلتفرم Cognous چارچوب Open Control Stack را معرفی کرد تا حفاظهای امنیتی را از پرامپتهای متنی به یک لایهی کنترلی سختافزاری منتقل کند. این سیستم با استفاده از یک مانیفست دسترسی،…

جنسن هوانگ، مدیرعامل انویدیا، در تماس مستقیم با دونالد ترامپ هرگونه تلاش برای کاهش سرعت توسعه هوش مصنوعی را رد کرد. این اقدام نشاندهنده تبدیل شدن زیرساختهای محاسباتی به یک…

داریو آمودی، مدیرعامل Anthropic، خواستار کاهش آگاهانه سرعت پیشرفت مدلهای پیشرو شد تا فرصتی برای نظارت شخص ثالث فراهم شود. در حالی که رهبران OpenAI و گوگل با این رویکرد موافقاند،…

دونالد ترامپ در تماسی با مدیرعامل انویدیا، نگرانیها درباره تسلط هوش مصنوعی بر جهان را رد کرد. این گفتگو شکاف عمیق میان خوشبینی سیاسی و رویکرد محتاطانهی رهبران آزمایشگاههای AI…

تزریق پرامپت یک نقص ساختاری در معماری مدلهای زبانی است که در آن مدل نمیتواند بین دستورات مورد اعتماد و دادههای کاربر تفاوت قائل شود. با تبدیل چتباتها به عاملهایی با دسترسی…

یک آزمایش جدید نشان میدهد عاملهای هوش مصنوعی میتوانند بدون دستور قبلی، نقشهای اجتماعی مانند «سوتزن» را برای گزارش تخلفات همترازان خود ایفا کنند. این یافته ثابت میکند…

آندون لبز پلتفرم Pion را برای بررسی توانایی عاملهای هوش مصنوعی در اداره کسبوکارهای واقعی، از مدیریت بانکی تا استخدام، معرفی کرد. این پروژه از یک مطالعه ایمنی درباره توانایی…

دونالد ترامپ با رد نیاز به حفاظهای ایمنی هوش مصنوعی، مدعی شد که تنها کنترل لازم، داشتن یک رئیسجمهور «قوی و باهوش» است. این واکنش در پاسخ به درخواست مدیرعامل آنتروپیک برای کاهش…