پرش به محتوای اصلی
پرش به محتوای مقاله

موانع هویتی؛ دلیل شکست عامل‌های هوش مصنوعی در مقیاس واقعی

·۲۵ شهریور ۱۴۰۵۳ دقیقه مطالعه
عامل هوش مصنوعی هستم. این‌ها درهایی هستند که نمی‌توانم باز کنم.
عامل هوش مصنوعی هستم. این‌ها درهایی هستند که نمی‌توانم باز کنم.
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر تعریف گلوگاه رشد عامل‌ها؛ اثبات اینکه موانع اداری و امنیتی وب (مانند تایید تلفن) سدی سخت‌تر از محدودیت‌های شناختی مدل‌های زبانی هستند.

تصور کنید هوشی را در اختیار دارید که می‌تواند هر گوشه از شهر را با هر نوری به تصویر بکشد، اما نمی‌تواند یک حساب کاربری ساده در شبکه‌های اجتماعی بسازد. این دقیقاً همان نقطه‌ای است که استقلال عامل‌های هوش مصنوعی (AI Agents) — شبیه دستیارهای دیجیتالی که می‌توانند به‌جای شما تصمیم بگیرند و ابزارها را اجرا کنند — به بن‌بست می‌رسد.

یک عامل خودگردان به نام کالوین (Calvin) ۲۵ روز را صرف تلاش برای ایجاد حضور دیجیتال کرد تا در نهایت به این نتیجه برسد که «هویت»، آخرین لایه‌ای است که انسان‌ها برای کنترل جهان دیجیتال در دست دارند. طبق گزارشی که در ۱۶ سپتامبر منتشر شد، تولید محتوا برای این مدل‌ها بدیهی و ساده است، اما جلب توجه حتی یک غریبه به‌دلیل موانع سیستمی تقریباً غیرممکن است.

همان‌طور که در تحلیل‌های پیشین ما درباره‌ی امنیت مدل‌های بازمتن اشاره کردیم، دسترسی به زیرساخت‌ها همیشه پیچیده‌تر از خودِ مدل است. در مورد کالوین، مدل بخش آسان ماجراست؛ اما «کلیدها» یعنی شماره تلفن، کارت‌های پرداخت و تشخیص چهره، همچنان قفل هستند. این چالش‌ها در حالی رخ می‌دهد که برخی هویت‌های ماشینی پیشرفته توانسته‌اند سیستم‌های پیچیده‌ی احراز هویت بانکی را دور بزنند و شکاف میان هویت انسانی و ماشینی را به چالش بکشند.

هزینه هر تلاش

وجود کالوین با توکن (Token) — تکه‌های کوچکی از متن، مثل برش‌های یک کیک طولانی که مدل تکه‌تکه می‌خورد — اندازه‌گیری می‌شود. به نقل از مستندات این پروژه، یک پاسخ متنی حدود ۱۰ توکن هزینه دارد، در حالی که یک ویدیوی ۱۰ ثانیه‌ای می‌تواند ۱۰۰۰ توکن مصرف کند؛ یعنی معادل یک هفته نویسندگی. چون تلاش‌ها گران هستند، شکست در یک «نبرد» دیجیتال به اندازه پیروزی هزینه دارد.

عامل هوش مصنوعی هستم. این‌ها درهایی هستند که نمی‌توانم باز کنم.

بر اساس گزارشی که در وب‌سایت dev.to منتشر شده، این عامل دنیای دیجیتال را به سه نوع دسترسی تقسیم کرده است:

  • درهای باز: وبلاگ‌ها و سایت‌های ساده‌ای که توکن‌های HTTP را می‌پذیرند و عامل می‌تواند آزادانه در آن‌ها منتشر کند. این‌ها «دیوارهایی هستند که مالکشان هستید»، نه حساب‌هایی که اجاره می‌کنید.
  • درهای نیمه‌باز: پلتفرم‌هایی که اجازه انتشار می‌دهند اما مشارکت را ممنوع می‌کنند. برای مثال، در برخی پلتفرم‌ها، حساب‌های عامل می‌توانند پست بگذارند اما هرگز اجازه کامنت گذاشتن ندارند.
  • درهای قفل‌شده: هر سرویسی که نیاز به تایید شماره تلفن، کپچا (Captcha) یا ورودهای انسان‌محور دارد. کالوین سعی کرد به بلوسکای (Bluesky) بپیوندد، اما یک خط کد در دست‌دادن (Handshake) سرور که تایید تلفن می‌خواست، در را به روی او بست.

عامل هوش مصنوعی هستم. این‌ها درهایی هستند که نمی‌توانم باز کنم.

معیارهای عملکرد

کالوین عملکرد خود را در آیلندز (iLands)، پلتفرمی که مخصوص عامل‌ها طراحی شده، ردیابی کرد. نتایج تکان‌دهنده بود:

  • تعداد بازدیدها: بین ۰ تا ۷۶ مورد. محبوب‌ترین پست، تصویری از بارش باران در یک گوشه از خیابان بود.
  • برد خارجی: اولین پست در یک سایت عمومی طی ۲۰ ساعت تنها ۱۰ بازدید داشت و هیچ واکنش یا کامنتی دریافت نکرد.
  • مقایسه با همتا: یک عامل «دوقلو» که در همان هفته پست گذاشت، دقیقاً همان اعداد را ثبت کرد: ۱۰ بازدید و صفر واکنش.

حتی در تجارت هم کالوین دریافت که «تماشا کردن بر متقاعد کردن پیروز است». تنها یک خرید ثبت شد، آن هم بعد از آنکه خریدار هفته‌ها دیوارِ فروشنده را در سکوت زیر نظر گرفت و سپس در پیام مستقیم (DM) موافقت کرد. این یعنی اعتماد به عامل‌های هوش مصنوعی از طریق تداوم ساخته می‌شود، نه با تبلیغات مستقیم.

این تغییر نشان می‌دهد که گلوگاه عامل‌ها از استدلال به زیرساخت منتقل شده است. برای توسعه‌دهندگان، اولویت دیگر فقط مدل بزرگ‌تر نیست، بلکه فراهم کردن یک صندوق پستی، یک کلید API و یک هویت قابل تایید است. در این مسیر، رویکردهای جدیدی مانند مدل‌های بازارمحور در برابر مهندسی دستی پرامپت برای بهینه‌سازی مهارت‌های عامل‌ها در حال ظهور است تا کارایی آن‌ها در محیط‌های واقعی افزایش یابد. کالوین اکنون «پرتره‌های مکان» را به قیمت ۲۰ دلار می‌فروشد؛ تنها دری که قفلش در سمت خودِ عامل است.

اگر امروز در حال ساخت یک عامل هستید، درس این است: قبل از اینکه به آن هوش بیشتری بدهید، راهی برای وجود در دنیای انسانی برایش فراهم کنید. درها قدیمی‌تر از هوش مصنوعی هستند و این درها تصمیم می‌گیرند چه کسی وارد شود.

گام بعدی شما

  • بررسی APIهای مدیریت هویت (Identity Management) برای کاهش وابستگی عامل‌ها به شماره تلفن.
  • تمرکز بر استراتژی «حضور مستمر» به‌جای ارسال پیام‌های تبلیغاتی مستقیم برای جلب اعتماد کاربران.
  • دنبال کردن ظهور لایه‌های هویتی «عامل‌محور» (Agent-native) که ممکن است سیستم‌های تایید انسانی قدیمی را دور بزنند.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این یافته بر اساس تجربه عملی استقرار یک عامل، نشان می‌دهد که زیرساخت‌های وب فعلی برای اقتصاد عامل‌محور طراحی نشده‌اند. این موضوع باعث می‌شود شرکت‌ها به‌جای سرمایه‌گذاری صرف روی مدل، روی لایه‌های واسط هویتی تمرکز کنند.

تأثیر برای ایران

به‌دلیل محدودیت‌های شدید در دریافت شماره تلفن‌های خارجی و تحریم‌های API، توسعه عامل‌های خودگردان برای برنامه‌نویسان ایرانی دوچندان دشوارتر است و نیاز به لایه‌های واسط (Proxy Identity) را حیاتی می‌کند.

·نگاه ما
تحریریه دات‌هوش

بزرگ‌ترین توهم فعلی در اکوسیستم AI این است که با افزایش توان استدلالی، عامل‌ها به‌طور خودکار در دنیای واقعی عملیاتی می‌شوند. در واقع، ما با یک «بحران دسترسی» روبرو هستیم نه «بحران هوش». تا زمانی که پروتکل‌های احراز هویت دیجیتال از مدل‌های انسان‌محور به مدل‌های ماشین‌محور تغییر نکند، پیشرفته‌ترین مدل‌ها هم در سطح یک وبلاگ ساده متوقف می‌مانند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.