پرش به محتوای اصلی
پرش به محتوای مقاله

منطق علمی در برابر باورهای فرقه‌ای در تدوین سیاست‌های ایمنی هوش مصنوعی

·۲۶ شهریور ۱۴۰۵۹ دقیقه مطالعه
تأییدنشده · منبع منفردگزارش تحقیقی
صفحه‌ای از اس‌ای گایگز | @segyges.bsky.social
صفحه‌ای از اس‌ای گایگز | @segyges.bsky.social
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

پیوند مستقیم میان زندگی شخصی و فرقه‌ای الیزر یودکوفسکی و تصمیمات استراتژیک مدیران OpenAI و Anthropic برای اولین بار با جزئیات مالی و سازمانی افشا شد.

تصور کنید زبان رسمی ایمنی هوش مصنوعی به‌جای اینکه حاصل علم تجربی باشد، محصول یک جنبش کیش‌مانند برای پیش‌بینی پایان جهان باشد. این ادعای تکان‌دهنده در ۱۷ سپتامبر ۲۰۲۶ توسط SE Gyges مطرح شد و نشان می‌دهد شبکه‌ای از نفوذ فکری با ریسک بالا میان OpenAI، Anthropic و Google DeepMind احتمالاً در یک «فرقه جنسی» در برکلی و به رهبری الیزر یودکوفسکی، نویسنده داستان‌های طرفداری (Fan-fiction)، شکل گرفته است.

سال‌هاست که صنعت هوش مصنوعی، همراستاسازی (Alignment) — شبیه تنظیم کردن یک قطب‌نما برای اینکه کشتی به‌جای صخره‌ها به مقصد برسد — را یک چالش فنی می‌بیند. اما این جنبش در زمانی ظهور کرد که قدرتمندترین آزمایشگاه‌های جهان به دنبال قوانینی هستند که عملاً یک کارتل تحقیقاتی ایجاد کند. برای درک دلیل این اتفاق، باید به جامعه «عقل‌گرایان» (Rationalists) نگاه کرد؛ گروهی که ابرهوش مصنوعی را یک آخرالزمان اجتناب‌ناپذیر می‌بینند. این گرایش به جای تکیه بر متدولوژی‌های علمی، به نوعی ایمان کورکورانه تبدیل شده است؛ موضوعی که در تحلیل‌های پیشین درباره انتقال تدریجی مرجعیت مذهبی در زیرساخت‌های پژوهشی هوش مصنوعی به آن پرداخته شد.

معماری نفوذ

الیزر یودکوفسکی (Eliezer Yudkowsky) یا «یود»، چهره مرکزی این اکوسیستم است. طبق این گزارش، یود همان پلی بود که شین لگ (Shane Legg) و دمیس هاسابیس (Demis Hassabis) را به پیتر تیل (Peter Thiel) متصل کرد تا سرمایه اولیه DeepMind تأمین شود؛ شرکتی که اکنون به عنوان بخش تحقیقات هوش مصنوعی گوگل فعالیت می‌کند.

نفوذ او به بالاترین سطوح سیاست‌گذاری و رهبری شرکتی رسیده است:

  • OpenAI: گزارش شده که رون (Roon)، یکی از کارکنان ارشد و سخنگوی غیررسمی شرکت، نظرات یود را حیاتی و مهم می‌داند، هرچند می‌پذیرد که یود در یک فرقه جنسی نقش دارد یا آن را اداره می‌کند.
  • Anthropic: داریو آمودی (Dario Amodei)، مدیرعامل این شرکت، از سال ۲۰۱۳ در وبلاگ غیرانتفاعی یود به عنوان عضو جامعه «نوع‌دوستی مؤثر» (EA) شناسایی شده است. آمودی پیش از این با یود درباره مفهوم «بهینه‌ساز گیره کاغذ» بحث کرده است، با این حال مقالات Anthropic همچنان در برخی موارد به یود استناد می‌کنند.
  • سیاست‌گذاری: یود به چهره‌های سیاسی برجسته‌ای مانند برنی سندرز درباره سیاست‌های هوش مصنوعی مشاوره داده است. او همچنین در مستند The AI Doc نتفلیکس ظاهر شده تا مواضع خود را به دفاع کند. در سال ۲۰۲۳، یود در مجله Time ظاهر شد و استدلال کرد که پذیرش ریسک جنگ هسته‌ای برای جلوگیری از فاجعه هوش مصنوعی منطقی است.

SE Gyges

پیوند عقل‌گرایان و نوع‌دوستی مؤثر (EA)

تلاشی مستمر برای جدا کردن سیاست‌های ایمنی هوش مصنوعی از ریشه‌های آن در یک فرقه جنسی که توسط یک نویسنده داستان‌های طرفداری شروع شده، وجود دارد. در حالی که برخی مدعی‌اند «نوع‌دوستی مؤثر» (Effective Altruism) موجودیتی مستقل است که دستورات خود را از یود نمی‌گیرد، این گزارش این ادعا را «مزخرف» می‌نامد. در واقع، افراد و ایده‌ها به‌ویژه در سان‌فرانسیسکو کاملاً با هم هم‌پوشانی دارند.

در جلسات یود با برنی سندرز، افرادی مانند جفری لادیش (از Palisade Research که توسط Coefficient تامین مالی می‌شود) و دانیل کوکوتایلو (نویسنده کتاب AI 2027 که توسط Survival and Flourishing Fund تامین مالی می‌شود) حضور داشتند. همگی این افراد به عنوان «نوع‌دوستان مؤثر» شناسایی شده‌اند. این موضوع نشان می‌دهد که تمایز بین «عقل‌گرایان» (تیم یود) و «نوع‌دوستان مؤثر» (تیم داریو) اغلب تنها یک رقابت برای جذب بودجه و جلب توجه در یک فضای مشترک است.

از داستان طرفداری تا سیاست‌های جهانی

«عهد عتیق» فکری این جنبش، کتاب هری پاتر و روش‌های عقل‌گرایی است؛ اثری در سبک داستان طرفداری که توسط یودکوفسکی نوشته شده است. این گزارش استدلال می‌کند که این متن یک جنبش مذهبی را در لباس «عقل‌گرایی» به راه انداخت و احتمالاً یکی از تاثیرگذارترین متون مذهبی مدرن است.

این زیرفرهنگ اصطلاح ایمنی هوش مصنوعی (AI Safety) را ترویج کرد. باور مرکزی آن‌ها این است که هوش مصنوعی به‌طور اجتناب‌ناپذیر به خودبهبودی بازگشتی (RSI) می‌رسد، از کنترل انسان خارج می‌شود و بشریت را «گیره کاغذ» می‌کند؛ اشاره‌ای به آزمایش ذهنی «بهینه‌ساز گیره کاغذ». این چارچوب «نابودی» همان روان‌رنجوری فرقه‌های هزاره‌گرایانه را فعال می‌کند: این باور که جهان در حال پایان است و تنها گروه خاصی از افراد داخلی می‌توانند جلوی آن را بگیرند.

کمون‌های برکلی

مرکز فیزیکی این جنبش در برکلی، کالیفرنیا و در «خانه‌های گروهی» مختلف قرار دارد؛ اصطلاحی که برای اینکه این کمون‌ها کمتر «فرقه‌ای» به نظر برسند، ابداع شده است. این خانه‌ها با ویژگی‌هایی چون چندهمسری (Polyamory)، ستایش جمعی چند نویسنده خاص و وسواس مشترک نسبت به نابودی جهان شناخته می‌شوند. آن‌ها به عنوان افرادی توصیف شده‌اند که «با هم، به‌شدت مخالف جریان اصلی» هستند.

لایت‌هون و ارتباط با FTX

برجسته‌ترین قطب این جریان، لایت‌هون (Lighthaven) است که پیش‌تر هتل Rose Garden Inn بود. این مکان در اواخر سال ۲۰۲۲ توسط یک خیریه عقل‌گرایان و با پول‌هایی خریداری شد که ادعا می‌شود توسط SBF درست پیش از فروپاشی صرافی FTX دزدیده شده بود. گزارش اشاره می‌کند که لئوپولد اشنبنر یکی از معدود افرادی بود که توانایی انتقال این وجوه را داشت؛ او بعدها با زنی ازدواج کرد که به عنوان رئیس کارکنان (Chief of Staff) در Anthropic فعالیت می‌کند.

لایت‌هون به عنوان مکانی برای چندین گروه هم‌پوشان عمل می‌کند:

  • The Curve: کنفرانسی برای پژوهشگران هوش مصنوعی.
  • EAGxBerkeley: کنفرانس نوع‌دوستی مؤثر.
  • MATS: برنامه همراستاسازی، شفافیت و امنیت ماشین (یا پژوهشگران تئوری و همراستاسازی ML).
  • گروه‌های مطالعه: گروه‌های محلی برای مطالعه Astral Codex Ten و The Sequences (که عهد عتیق عقل‌گرایان محسوب می‌شوند).
  • SlutCon: رویدادی که توسط آئلا (Aella) سازمان‌دهی می‌شود و شامل فتیش‌های شدید و اورگی‌های پولی است.

پویایی‌های داخلی و اتهامات

گرتا (Gretta)، شریک اصلی یودکوفسکی، گزارش شده است که علی‌رغم نداشتن هیچ‌گونه صلاحیت قبلی برای این نقش، حقوق ۲۰۰ هزار دلاری به عنوان دستیار از سازمان غیرانتفاعی او دریافت می‌کند. او همچنین سازمان‌دهنده SlutCon و اورگی‌های پولی در لایت‌هون است.

مدیر تأسیسات، رونی هرناندز، هم‌زمان به عنوان مدیر برنامه‌های آئلا نیز فعالیت می‌کند. گزارش اشاره می‌کند که مشخص نیست آیا این نقش تنها به «پروژه‌های خنده‌دار علم داده» محدود است یا شامل فعالیت به عنوان یک «قواد» (Pimp) نیز می‌شود.

جزئیات بیشتر درباره ماهیت جنسی این جامعه عبارت است از:

  • آئلا: چهره‌ای برجسته که به‌طور تهاجمی در توییتر برای «سبک زندگی سکسی» خود عضو جذب می‌کند و دارای تمایلات مستند به فتیش تجاوز است.
  • نمودارهای سانکی: آئلا نمودارهایی از روابط جنسی تولید کرده است و گزارش اشاره می‌کند که احتمالاً یودکوفسکی یکی از شرکت‌کنندگان در این نمودارهاست.
  • پوشش رسانه‌ای: روزنامه New York Post درباره «زندگی وحشیانه» این پیش‌گوی نابودی، از جمله مهمانی‌های جنسی تولد و حضور ستاره‌های OnlyFans گزارش داده است.

هزینه انسانی و رادیکالیزه شدن

این گزارش پیشنهاد می‌کند که این جنبش مانند یک «کارخانه فرقه» عمل می‌کند. این محیط منجر به نتایج افراطی شده است. برای مثال، فردی که سعی کرد خانه سم آلتمن را با بمب مولوتوف بسوزاند، یودکوفسکی را منبع الهام اصلی خود نامید.

جذب اعضا اغلب ایده‌آل‌گرایان جوان را از طریق دروازه داستان‌های طرفداری هری پاتر هدف قرار می‌دهد. پس از ورود، آن‌ها به سبک زندگی‌ای سوق داده می‌شوند که در آن ترس از آخرالزمان با رهایی جنسی و زندگی جمعی گره خورده است. این امر یک حلقه بازخورد ایجاد می‌کند که در آن موعظه پیش‌گویی‌های روز قیامت به ابزاری برای تأمین بودجه و حفظ کمون تبدیل می‌شود. گزارش به سایر شاخه‌های شکست‌خورده مانند «زیزیان» (Zizians) نیز اشاره می‌کند.

گامبیت رگولاتوری (قانون‌گذاری)

پیامد consequentialترین این نفوذ، فشار اخیر سم آلتمن، ایلان ماسک، داریو آمودی و دمیس هاسابیس برای لغو قوانین ضد انحصار است. آن‌ها استدلال می‌کنند که این کار برای «تنظیم سرعت» یا کند کردن تحقیقات جهت تضمین ایمنی ضروری است.

منتقدان استدلال می‌کنند که این موضوع ربطی به ایمنی ندارد، بلکه تلاشی برای تشکیل یک کارتل است. با قاب‌بندی رگولاتوری به عنوان نیازی برای «توقف»، «وقفه» یا «کند کردن» تحقیقات، این رهبران در حال اعمال منطق هزاره‌گرایانه بر صنعت جهانی هستند. این رویکرد می‌تواند به‌طور بالقوه تحقیقات حیاتی پزشکی را متوقف کند، زیرا بخش بزرگی از توسعه مدرن هوش مصنوعی در حال حاضر در حوزه بهداشت و درمان به کار گرفته شده است. گزارش این وضعیت را با شرکت‌های دارویی مقایسه می‌کند که کارتلی تشکیل دهند تا تحقیقات پزشکی را برای جلوگیری از یک ریسک تئوریک ممنوع کنند. این نوع نگاه ابزارانگاری به داده‌ها و انسان‌ها، یادآور هشدارهای مذهبی است؛ همان‌طور که پاپ لئو چهاردهم استخراج داده‌های انسانی را شکل جدیدی از استعمار دیجیتال توصیف کرده است.

تحلیل: اقتصاد نابودی

این افشاگری نشان می‌دهد که ایمنی هوش مصنوعی یک حوزه فنی خنثی نیست، بلکه یک «کارخانه فرقه» است. وقتی انگیزه اصلی برای قانون‌گذاری، یک وسواس روان‌رنجانه نسبت به آخرالزمان باشد، سیاست‌های حاصله احتمالاً غیرمنطقی خواهند بود.

برای یک رهبر کسب‌وکار، این بدان معنای است که استدلال‌های «ایمنی» که برای توجیه مدل‌های بسته (Closed-source) یا تسخیر رگولاتوری (Regulatory Capture) استفاده می‌شوند، ممکن است توسط نیازهای روان‌شناختی گروه کوچک و منزوی در برکلی هدایت شوند، نه ارزیابی‌های واقعی ریسک. روایت «نابودی» به محصولی سودآور تبدیل می‌شود که بودجه و دسترسی سیاسی را تضمین می‌کند. اگر شرح دادن پیش‌گویی‌های روز قیامت پولساز باشد، انگیزه این است که صرف‌نظر از شواهد، به موعظه آن‌ها ادامه دهند.

منتظر موج بعدی درخواست‌های لغو قوانین ضد انحصار در بخش هوش مصنوعی باشید. اگر روایت «بهینه‌ساز گیره کاغذ» همچنان سیاست‌ها را هدایت کند، ممکن است شاهد تغییر به سمت یک دولت جهانی هوش مصنوعی باشیم که توسط همان افرادی مدیریت می‌شود که ادعا می‌کنند این فناوری غیرقابل کنترل است.

چرا این موضوع مهم است؟

این افشاگری اعتبار مفهومی «ایمنی» را در سطح صنعت لرزاند و نشان داد که سیاست‌های نظارتی جهانی ممکن است بر اساس وسواس‌های یک گروه کوچک و نه تحلیل‌های ریسک تجربی باشد. این موضوع اعتماد به نهادهای نظارتی AI را به شدت کاهش می‌دهد.

تأثیر برای ایران

این خبر اثر مستقیمی بر کاربران ایرانی ندارد، اما برای توسعه‌دهندگان ایرانی که از مدل‌های بازمتن استفاده می‌کنند، تأییدی است بر اینکه فشار برای «بستن» مدل‌ها تحت عنوان ایمنی، بیشتر ریشه در سیاست‌های انحصاری دارد تا خطرات فنی.

·نگاه ما
تحریریه دات‌هوش

روایت «آخرالزمان» در ایمنی هوش مصنوعی دیگر یک هشدار علمی نیست، بلکه به یک مدل کسب‌وکار تبدیل شده است. وقتی ترس از نابودی جهان، دسترسی سیاسی و بودجه‌های میلیاردی را تضمین کند، انگیزه‌ی مدل‌ها برای «حل مشکل» از بین می‌رود و جای خود را به «تولید مداوم ترس» می‌دهد. این یعنی بسیاری از محدودیت‌های فعلی مدل‌های تجاری، نه برای محافظت از انسان، بلکه برای توجیه انحصار بازار توسط چند شرکت خاص طراحی شده‌اند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.