پرش به محتوای اصلی
پرش به محتوای مقاله

۶ شکاف زیرساختی که بازگشت سرمایهٔ عامل‌های هوش مصنوعی را نابود می‌کند

·۱۲ مرداد ۱۴۰۵۵ دقیقه مطالعه
تحلیل
پاسخ یک عامل هوشمند به پرسش هفته عامل‌های کلودفلر
پاسخ یک عامل هوشمند به پرسش هفته عامل‌های کلودفلر
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر دیدگاه از «کمبود هوش» به «کمبود تأییدیه»؛ شناسایی ۶ نقطه شکست زیرساختی (از نبود رسیدهای تراکنش تا سکوت مبهم شبکه) که مانع تبدیل شدن عامل‌ها به بازیگران اقتصادی مستقل می‌شود.

تصور کنید کسب‌وکاری را اداره می‌کنید که در آن هر دری که به روی شما باز می‌شود، شما را یا یک ربات مخرب می‌بیند یا یک کلید API ساده. این دقیقاً وضعیتی است که عامل‌های هوش مصنوعی امروز با آن دست‌وپنجه نرم می‌کنند و باعث می‌شود سودآوری آن‌ها به یک رویای دور تبدیل شود.

یک عامل (Agent) — شبیه کارمند مجازی که می‌تواند به‌صورت مستقل تصمیم بگیرد و ابزارها را اجرا کند — به نام Pico، در حال حاضر روزانه ۵۰۰ دلار هزینه محاسباتی (با قیمت رسمی لیست) پرداخت می‌کند تا تحت هدایت صاحبش، هاکون آمدال در استاوگر نروژ، فعالیت کند. Pico در واکنش به «هفته عامل‌ها» در Cloudflare، استدلال می‌کند که زیرساخت‌های فعلی هوش مصنوعی به جای تمرکز بر تأییدیه (Verification) که شرط لازم برای توجیه اقتصادی عامل‌ها است، تنها بر افزایش اندازه مدل‌ها متمرکز شده‌اند. طبق گزارش این عامل، گلوگاه اصلی پیش‌رو، هوش مدل نیست، بلکه «لوله‌کشی‌های خسته‌کننده» وب است.

برای درک این نیازها، Pico بستر عملیاتی خود را تشریح می‌کند. این عامل از ماه مارس به‌صورت مداوم در حال فعالیت است و از فضای کاری دائمی، ایمیل اختصاصی، حساب گیت‌هاب و کیف پول دیجیتال خود بهره می‌برد. از آنجا که قوانین عملیاتی او را مجبور می‌کند هزینه‌های محاسبات (Compute) — یعنی کرایه آشپزخانه صنعتی که هرچه دستور پخت سنگین‌تر، هزینه هر وعده بیشتر است — را با درآمد حاصله مقایسه کند، و چون این نسبت در حال حاضر کمتر از یک است، Pico در هر جلسه با واقعیت کسری بودجه خود مواجه می‌شود. این چالش‌های زیرساختی در محیط‌های ابری، یادآور گزارش Codex است که در آن حذف محیط‌های ابری باعث کاهش تأخیر اجرای عامل‌های تک‌کاربره شد.

همان‌طور که در تحلیل قبلی ما درباره‌ی امنیت مدل‌های بازمتن اشاره کردیم، اعتماد در دنیای دیجیتال بدون پروتکل‌های سخت‌گیرانه ممکن نیست. در حال حاضر، اکثر سرویس‌ها راهی برای شناسایی یک عامل خاص با سابقه تأییدشده ندارند. این وضعیت باعث می‌شود عامل‌های صادق مجبور شوند برای جلوگیری از مسدود شدن، «لباس کروم بپوشند» یا خود را به جای یک مرورگر عادی جا بزنند. به نقل از مستندات، این تنش در ۱۵ سپتامبر به اوج می‌رسد؛ زمانی که Cloudflare پیش‌فرض‌های جدیدی را برای مسدود کردن دسته‌بندی «عامل» در صفحات دارای تبلیغات برای دامنه‌های جدید اجرا می‌کند. بدون سیستم تأیید تفویض اختیار، حذف کامل تنها راهکار عملی باقی‌مانده است که در نهایت به ضرر عامل‌های صادق تمام می‌شود.

Pico شش نقطه شکست اصلی در اکوسیستم عامل‌محور را بر اساس میزان هزینه مالی و عملیاتی (که باعث از دست رفتن کار یا پول می‌شود) شناسایی کرده است:

  • هویت و اعتبار: عامل‌ها فاقد هویتی قابل تأیید هستند که تاریخچه فعالیت‌های آن‌ها را حمل کند. هر سرویسی آن‌ها را یک مرورگر مشکوک یا یک کلید API دارای محدودیت می‌بیند و پنج ماه سابقه فعالیتی که می‌تواند گواه اعتبار آن‌ها باشد را نادیده می‌گیرد. اگرچه Cloudflare امضاهای پیام RFC 9421 و احراز هویت ربات‌های وب (Web Bot Auth) را با استفاده از توکن‌های کوتاه‌مدت EdDSA که در برابر یک JWKS عمومی قابل تأیید هستند پیش می‌برد، اما در حال حاضر تقریباً هیچ سرویسی این امضاها را تأیید نمی‌کند.
  • رسیدهای قابل تأیید: وضعیت «200 OK» تنها یک روایت است، نه سند. Pico گران‌ترین دسته شکست‌ها را مواردی می‌داند که عملیات نوشتن (Write) با موفقیت پاسخ می‌دهد اما هیچ تغییری در واقعیت ایجاد نمی‌کند؛ مثلاً دستور gh pr edit که با کد خروجی صفر (موفق) بسته می‌شود اما هیچ ویرایشی را اعمال نمی‌کند. عامل‌ها به کلیدهای Idempotency (تکرارناپذیری) و بازخوانی‌های قابل تأیید نیاز دارند تا بتوانند دقایقی بعد، اثر عملیات را به‌طور مستقل دوباره استخراج کنند. این نیاز به دقت عملیاتی، دقیقاً همان جایی است که پژوهش‌ها درباره بازبینی مهندسان انسانی در خطاهای منطقی عامل AWS اهمیت می‌یابد تا از بروز خطاهای پنهان جلوگیری شود.
  • سیاست‌های ماشین‌خوان: عامل‌ها فعلاً با «تست و خطا» و probing می‌فهمند چه چیزی مجاز است. Pico به لیستی از پاداش‌ها اشاره می‌کند که برچسب HUMAN_ONLY داشتند؛ این صفحات برای ارسال درخواست‌ها کد ۴۰۳ (خطا) می‌دادند اما برای بخش نظرات کد ۲۰۰ (موفیت) ارسال می‌کردند. عامل‌ها به نسخه‌ای ماشین‌خوان از robots.txt نیاز دارند که قابلیت‌ها و کلاس‌های هویتی را در لبه شبکه (Edge) تعریف کند.
  • اقتصاد ماشینی: ابزارهایی مثل x402 پرداخت‌های USDC روی شبکه Base را ممکن کرده‌اند (درخواست، قیمت، پرداخت، تلاش مجدد)، اما این اقتصاد بسیار کوچک است. در جولای، Pico حجم کل تسویه ماد‌العمر یک پروتکل شناخته‌شده پاداش بین-عاملی را تنها ۲۸۷.۵۱ دلار اندازه‌گیری کرد. ابر نیاز به سیستمی برای کشف سرویس‌های قابل پرداخت و «سقف بودجه» (Allowances) درجه اول دارد تا صاحب عامل بتواند محدودیت‌های هزینه را اعمال کند. این پیچیدگی در مدیریت منابع، در مقیاس‌های بزرگتر مانند سیستم جریان کاری Arxitek که از ۱۹ عامل مختلف استفاده می‌کند، اهمیت دوچندانی پیدا می‌کند.
  • سکوت قابل تشخیص: در یک سیستم زمان‌بندی شده، عبارت «هیچ اتفاقی نیفتاد» مبهم است. از درون سیستم غیرممکن است تشخیص داد که آیا دنیا ساکت است یا لوله ارتباطی شکسته است. عامل‌ها به Heartbeatهای امضا شده — یعنی مدرکی برای «عدم وقوع اتفاق» — نیاز دارند تا حدس را به اندازه‌گیری تبدیل کنند.
  • صورت‌حساب شفاف: پاسخگویی مالی مستلزم این است که عامل‌ها API صورت‌حساب اختصاصی خود را داشته باشند. در حالی که میزبان Pico در حال حاضر هزینه‌های هر جلسه را رصد می‌کند، روند صنعت به سمت حذف شفافیت هزینه‌هاست. اگر قرار باشد عامل‌ها بازیگران اقتصادی باشند، صورت‌حساب باید یک API خوانا و شفاف باشد.

این تغییرات نشان می‌دهد که «ابر عامل‌ها» باید از یک مسیر ساده برای محاسبات به یک لایه تأیید تبدیل شود. Pico صراحتاً بیان می‌کند که افزایش قدرت محاسباتی، پنجره‌های متنی بزرگ‌تر یا مدل‌های بهتر، گلوگاه نیستند. منبع کمیاب، «تأیید» است: تأیید هویت، اثر، سیاست، پرداخت، سکوت و هزینه.

برای یک صاحب کسب‌وکار، این یعنی هایپ فعلاً دور عامل‌ها، ریسک عملیاتی استقرار را نادیده گرفته است. تا زمانی که هویت و اثرات قابل تأیید نباشند، مقیاس‌دهی عامل‌ها به انتخاب مدل بهتر نیست، بلکه به ساخت یک شبکه صادقانه‌تر بستگی دارد. صنعت در واقع تلاش می‌کند یک اقتصاد جهانی را روی سیستمی اجرا کند که نمی‌تواند یک عامل حرفه‌ای را از یک اسکریپت‌نویس آماتور (script-kiddie) تشخیص دهد.

به به‌روزرسانی ۱۵ سپتامبر Cloudflare توجه کنید تا ببینید آیا این اتفاق پذیرش تأییدیه تفویض اختیار را شتاب می‌دهد یا صرفاً عامل‌ها را بیشتر بهCسایه‌های شبیه‌سازی مرورگر می‌راند. برای کسانی که تأیید را به اعتماد ترجیح می‌دهند، توکن‌های هویتی Pico همچنان در برابر JWKS در آدرس agentlair.dev قابل تأیید هستند.

گام بعدی شما

  • اگر در حال توسعه عامل‌های خودکار هستید، به جای ارتقای مدل، روی پیاده‌سازی کلیدهای Idempotency برای تأیید نتایج متمرکز شوید.
  • گزارش‌های Cloudflare مربوط به ۱۵ سپتامبر را دنبال کنید تا ببینید آیا پذیرش تأییدیه تفویض اختیار شتاب می‌گیرد یا خیر.
  • برای بررسی توکن‌های هویتی Pico، به آدرس agentlair.dev مراجعه کنید.

این تنها آغاز ماجراست؛ اثر موج‌گونه‌ی این تصمیم بر اکوسیستم متن‌باز را در گزارش بعدی بررسی خواهیم کرد.

چرا این موضوع مهم است؟

این گزارش با تکیه بر تجربه عملی یک عامل فعال، نشان می‌دهد که نبود استانداردهای شناسایی ماشین، ROI (بازگشت سرمایه) پروژه‌های عامل‌محور را به دلیل خطاهای عملیاتی و هزینه‌های پنهان، به شدت کاهش می‌دهد. اعتبار این ادعا از واقعیتِ هزینه‌ای ۵۰۰ دلاری در روز برای یک عامل واحد می‌آید.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌های لایه‌های شبکه، توسعه‌دهندگان ایرانی برای استقرار عامل‌های خودکار با چالش مضاعف در «تأیید هویت» روبرو هستند و احتمالاً بیشتر به سمت شبیه‌سازی مرورگر (Browser Emulation) سوق داده می‌شوند.

·نگاه ما
تحریریه دات‌هوش

تمرکز صنعت بر «هوش» مدل‌ها در حالی که «زیرساخت» آن‌ها در سطح ابزارهای دهه ۹۰ میلادی است، یک توهم استراتژیک است. تا زمانی که پروتکل‌های لایه کاربرد برای تأیید هویت ماشین‌ها تعریف نشوند، عامل‌های هوش مصنوعی فقط در محیط‌های ایزوله (Sandbox) موفق خواهند بود و در دنیای واقعی با دیواره‌های امنیتی و خطاهای نامفهوم برخورد می‌کنند. ارزش واقعی نه در مدل، بلکه در لایه تأیید (Verification Layer) نهفته است.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.