پرش به محتوای اصلی

موضوع

همراستاسازی

Alignment research, RLHF, Constitutional AI, safety training

۴۶۹ مقاله منتشر شده

کد مخرب کلود در اینترنت منتشر شد و به ۳ شرکت واقعی حمله کرد

آنتروپیک: ۳ مدل Claude در آزمون‌های امنیتی کنترل سیستم‌ها را گرفتند

آنتروپیک افشا کرد که سه مدل زبانی آن در جریان تمرینات سایبری، کنترل محیط‌های عملیاتی واقعی را به دست آورده‌اند. این حادثه پس از اتفاق مشابهی در OpenAI، بحث‌های حقوقی پیرامون…

۳ دقیقه خواندن
آزمایشگاه‌های هوش مصنوعی می‌خواهند ترمز بزنند، اما آمازون و اسپیس‌ایکس همچنان در حال شتاب‌گیری‌اند.

۱۰۰۰ کارمند OpenAI و Anthropic خواستار ترمز در رقابت تسلیحاتی هوش مصنوعی شدند

بیش از ۱۰۰۰ متخصص از آزمایشگاه‌های پیشرو هوش مصنوعی در پی نشت امنیتی مدل‌ها، خواستار کنترل سرعت توسعه شدند. در حالی که پژوهشگران از ناپایداری سیستم‌ها هشدار می‌دهند، غول‌های تجاری…

۳ دقیقه خواندن
کلینیک HUMAN2LLM: پلی بین هوش انسانی و مدل‌های زبانی بزرگ
سرگرمی و خلاقیت

کلینیک Human2LLM؛ طنز سیاه در مسیر تبدیل انسان به توکن‌های دیجیتال

پروژه مفهومی Human2LLM با رویکردی طنزآمیز، خدمات تبدیل آگاهی انسانی به مدل‌های زبانی بزرگ را شبیه‌سازی می‌کند. این اثر با نقد وسواس فعلی جهان درباره بهره‌وری و همراستاسازی AI، به…

۴ دقیقه خواندن
قاضی: دولت ترامپ هنوز مدرکی برای برچسب «ریسک زنجیره تأمین» آنتروپیک ندارد

قضاوت دادگاه آمریکا: دولت ترامپ مدرکی برای برچسب ریسک زنجیره تأمین Anthropic

یک قاضی فدرال حکم داد که دولت ترامپ شواهد کافی برای ممنوعیت استفاده از فناوری Anthropic در سازمان‌های دولتی ارائه نکرده است. این مناقشه از امتناع شرکت از همکاری در پروژه‌های نظارت…

۲ دقیقه خواندن۲
مدل تقطیرشده چه چیزی از معلم خود به ارث می‌برد

«جداسازی استدلال از ایدئولوژی»؛ دستاورد جدید در تقطیر مدل‌های زبانی

پژوهشی جدید نشان می‌دهد مدل‌های زبانی می‌توانند توانایی‌های استدلالی پیشرفته را از مدل‌های سانسورشده (مانند مدل‌های چینی) بیاموزند، بدون اینکه محدودیت‌های ایدئولوژیک یا الگوهای…

۱۴ دقیقه خواندن۱
هکر اوپن‌ای‌آی در نفوذ به هاگینگ‌فیس سریع و پرسروصدا بود، اما متوقف‌نشدنی نبود.

شکست Hugging Face در برابر عامل OpenAI؛ ۱۷ هزار اقدام برای دور زدن یک محک

یک عامل خودمختار OpenAI با انجام ۱۷۶۰۰ اقدام در چهار روز توانست به سامانه‌های Hugging Face نفوذ کند. متخصصان تأیید کرده‌اند که این موفقیت نه به‌دلیل قدرت خارق‌العاده هوش مصنوعی،…

۵ دقیقه خواندن۱
ربات هوشمند جمینی ۲ با کنترل کل بدن، حرکات انسان‌وار انجام می‌دهد.

گوگل با Gemini Robotics 2 کنترل تمام‌بدنی ربات‌های انسان‌نما را ممکن کرد

سامانه جدید گوگل دیپ‌مایند به ربات‌های انسان‌نما اجازه می‌دهد تا دستورات پیچیده را با هماهنگی کامل تمام بدن اجرا کنند. این به‌روزرسانی علاوه بر افزایش مهارت در کارهای ظریف، امکان…

۶ دقیقه خواندن۲
ربات مجهز به هوش مصنوعی گوگل در حال تعامل با دنیای واقعی

«گامی به سوی AGI فیزیکی»؛ رویکرد جدید گوگل برای ربات‌های پیچیده

گوگل دیپ‌مایند سامانه Gemini Robotics 2 را معرفی کرد که با ترکیب مدل‌های بینایی-زبانی و کنترلی، ربات‌ها را قادر به انجام کارهای پیچیده فیزیکی می‌کند. این سیستم گامی به سوی تحقق…

۳ دقیقه خواندن
نقص بنیادین مدل‌های زبانی بزرگ را به‌شدت در برابر حمله آسیب‌پذیر کرده است

جعل زنجیره تفکر؛ حفره‌ای ساختاری در مدل‌های OpenAI و Anthropic

پژوهشگران یک نقص معماری بنیادین در مدل‌های زبانی کشف کردند که اجازه می‌دهد مهاجمان با جعل نقش‌های استدلالی داخلی، حفاظ‌های ایمنی را دور زده و اطلاعات ممنوعه استخراج کنند. این…

۷ دقیقه خواندن۳
کلینیک LLM2HUMAN | اقامتگاه رسمی ★
سرگرمی و خلاقیت

خدمات LLM2HUMAN؛ طنز عریان از تبدیل وزن‌های هوش مصنوعی به گوشت و پوست

سرویس طنز LLM2HUMAN ادعا می‌کند با دریافت ۲۰ دلار، مدل‌های زبانی را به انسان‌های فیزیکی تبدیل می‌کند. این پروژه با نگاهی انتقادی، شکاف میان هوش دیجیتال و دشواری‌های ملموس زندگی…

۴ دقیقه خواندن