پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۰ مقاله منتشر شده

ترامپ تعطیلی Anthropic را رقم زد؛ استدلالی برای هوش مصنوعی غیرآمریکایی

سیاست‌های کاخ سفید مدل‌های Fable و Mythos را برای خارجی‌ها مسدود کرد

دولت ترامپ شرکت Anthropic را مجبور کرد تا دسترسی کاربران خارج از آمریکا به قدرتمندترین مدل‌های خود را مسدود کند. این اقدام موجی از تلاش برای دستیابی به هوش مصنوعی حاکمیتی در اروپا…

۲ دقیقه خواندن
هوش مصنوعی خطرناک در راه است، فارغ از هر اقدامی

مدل‌های بازمتن اثربخشیِ محدودیت‌های صادراتی آمریکا را کاهش دادند

دولت آمریکا دسترسی خارجی به مدل‌های پیشرفته Anthropic را به دلیل مخاطرات امنیتی مسدود کرد. با این حال، کارشناسان هشدار می‌دهند که محدود کردن یک شرکت بی‌فایده است، زیرا قابلیت‌های…

۴ دقیقه خواندن
چرا معماری PACT در محیط‌های ناشناخته از مدل‌های RL پیشی می‌گیرد؟

معماری PACT نرخ شکست عامل‌های RL در محیط‌های جدید را کاهش داد

پژوهشگران معماری ترکیبی PACT را معرفی کرده‌اند که یک مدل زبانی کوچک را برای برنامه‌ریزی استراتژیک با سیاست‌های یادگیری تقویت‌شده ترکیب می‌کند. این سیستم با اعتبارسنجی نامتقارن…

۱ دقیقه خواندن
چرا پرامپت‌های سیستمی می‌توانند مدل‌های زبانی را به سمت استبداد سوق دهند؟

سند AuAu در برابر لایه‌های ایمنی فعلی مدل‌های زبانی پیشرو

بنچمارک جدید AuAu نشان می‌دهد که ۱۵ مدل از ۱۷ مدل زبانی پیشرو، در برابر دستورات سیستمی که ترویج دیدگاه‌های استبدادی می‌کنند، آسیب‌پذیرند. این یافته‌ها نشان می‌دهد که لایه‌های…

۱ دقیقه خواندن۱
چرا افزودن لایه‌های بیشتر در مدل‌های عمیق دیگر جواب نمی‌دهد؟

جریان باقی‌مانده در برابر NAG: گذار به مدل‌های بهینه‌تر و عمیق‌تر

پژوهشگران با معرفی معماری NAG مانع از زوال سیگنال در مدل‌های ترنسفورمر می‌شوند. این رویکرد با جداسازی اندازه از جهت در جریان باقی‌مانده، امکان ایجاد مدل‌های بسیار عمیق و بهینه را…

۲ دقیقه خواندن۳
چگونه معماری PHA مصرف حافظه در متون طولانی را ۴۰٪ کاهش داد؟

چگونه معماری PHA مصرف حافظه در متون طولانی را ۴۰٪ کاهش داد؟

پژوهشگران با معرفی معماری ترکیبی موازی (PHA)، مدل‌های حالت-فضا و مکانیسم توجه را در شاخه‌های مجزا ادغام کرده‌اند. این رویکرد دقت مدل‌های ترانسفورمر را حفظ کرده و هم‌زمان سرعت…

۱ دقیقه خواندن۲
چرا مدل‌های چندوجهی در استناد به تصاویر اسناد طولانی شکست می‌خورند؟

چرا مدل‌های چندوجهی در استناد به تصاویر اسناد طولانی شکست می‌خورند؟

پژوهشگران چارچوب VinQA را برای ارزیابی توانایی مدل‌های هوش مصنوعی در استناد دقیق به عناصر بصری (جداول و نمودارها) در پاسخ‌های طولانی معرفی کردند. نتایج نشان می‌دهد تنظیم دقیق…

۲ دقیقه خواندن۱