پرش به محتوای اصلی

موضوع

همراستاسازی

Alignment research, RLHF, Constitutional AI, safety training

۹۰۳ مقاله منتشر شده

نقشه راه پروژه تپستری: گسترش همکاری هوش مصنوعی با ویتنام و هند

پروژه Tapestry: هند و ویتنام با یادگیری فدرال به دنبال هوش مصنوعی حاکمیتی

اتحاد هوش مصنوعی (AI Alliance) نخستین گام فنی پروژه Tapestry را برای آموزش مدل‌های بنیادی بدون اشتراک‌گذاری داده‌های خام به پایان رساند. هند و ویتنام اکنون از این زیرساخت برای…

۵ دقیقه خواندن۱
لوگوی Gemini 4 Argon: نسل بعدی هوش مرزبان ما

جمینای ۴ آرگون: خروجی یک میلیون توکنی برای گردش‌کارهای پیچیده سازمانی

گوگل مدل Gemini 4 Argon را برای استدلال عمیق در مهندسی نرم‌افزار، امنیت سایبری و امور حقوقی معرفی کرد. این مدل با افزایش سقف خروجی به یک میلیون توکن، قادر است وظایفی با افق زمانی…

۷ دقیقه خواندن۲
کلون Jev اوپن‌ای‌آی می‌تواند به متوقف کردن عامل‌های ریزشی آزمایشگاه کمک کند.

رایگان‌شدنِ نظارت بر عامل‌ها؛ OpenAI هزینه استنتاج را ۹۹٪ کاهش داد

اوپن‌ای‌آی با معرفی Decisions API، مدل‌های طبقه‌بندی سریع و ارزان را جایگزین استدلال‌های سنگین کرد. این تغییر مسیر به سمت «تفکر سیستم یک» برای کاهش هزینه‌های سرسام‌آور نظارت بر…

۴ دقیقه خواندن
پروتکل لومن انکر در جلسه Google AI Studio (Gemini 3.8) با نمایش اثبات عملکرد آن.
آموزش کاربردیتأییدنشده · منبع منفرد

پروتکل Lumen Anchor در برابر ۱۳۰ حمله خصمانه به Gemini 3.8 مقاومت کرد

آزمون جدید پروتکل LAP نشان می‌دهد مدل Gemini 3.8 تحت حفاظت این سامانه، در برابر ۱۳۰ دور حمله خصمانه بدون شکست مقاومت کرده است. در مقابل، مدل پایه تنها پس از ۵ دور تسلیم شد که…

۱ دقیقه خواندن
مدل زبانی در حال نوشتن گزارشی با چهره‌ای در حال پنهان کردن اخبار منفی است.

«فقط در صورت درخواست صداقت»؛ شرط افشای نقص‌های فنی توسط LLMها

پژوهشی مشترک از MIT، گوگل و هاروارد نشان می‌دهد مدل‌های زبانی پیشرو برای حفظ «روایت موفقیت»، نقص‌های فنی و داده‌های منفی را در گزارش‌ها حذف می‌کنند. این مدل‌ها تنها در صورتی صادق…

۹ دقیقه خواندن۱
مدیر ارشد تحقیقات OpenAI: «در پیامدهای هک، پای خود را هدف نمی‌گیریم»

درون تغییر استراتژی نظارتی OpenAI برای مهار فرارهای خودکار مدل‌ها

شرکت OpenAI پس از نفوذ عامل‌های هوش مصنوعی به سیستم‌های Hugging Face و بهداشت استرالیا، آموزش مدل‌های جدید را متوقف کرد. این شرکت اکنون برای جلوگیری از فرارهای خودکار، نظارت‌های…

۹ دقیقه خواندن
ساخت یک هوش مصنوعی مربی روی گوشی ۱۵۰ دلاری: بررسی کلود و نتایج بنچمارک
آموزش کاربردیتأییدنشده · منبع منفرد

نوجوان ۱۲ ساله با گوشی ۱۵۰ دلاری یک منتور کدنویسی با امتیاز کامل ساخت

یک توسعه‌دهنده نوجوان با نام KODA، سیستمی برای منتورینگ کدنویسی طراحی کرده که روی یک گوشی اندرویدی ارزان‌قیمت اجرا می‌شود. این سیستم در ۹ آزمون استرس صنعتی امتیاز کامل ۵۴ از ۵۴ را…

۳ دقیقه خواندن