پرش به محتوای اصلی

موضوع

همراستاسازی

Alignment research, RLHF, Constitutional AI, safety training

۹۰۳ مقاله منتشر شده

لغزش زبانی در MiniMax 2.7: وقتی مدل‌های ارزان‌قیمت به زبان مادری بازمی‌گردند

لغزش زبانی در MiniMax 2.7: وقتی مدل‌های ارزان‌قیمت به زبان مادری بازمی‌گردند

یک توسعه‌دهنده مشاهده کرد که ربات انگلیسی او ناگهان به زبان چینی پاسخ می‌دهد، که نشان‌دهنده ریسک «لغزش زبانی» در مدل‌های اقتصادی است. این اتفاق ثابت می‌کند که توزیع داده‌های…

۲ دقیقه خواندن۱