پرش به محتوای اصلی
پرش به محتوای مقاله

هزینهٔ توکن‌های هوش مصنوعی در متا به اندازهٔ حقوق مهندسان خواهد رسید

·۲۳ تیر ۱۴۰۵۳ دقیقه مطالعه
آدام موسری: بودجه توکن هوش مصنوعی برای هر مهندس محدود می‌شود
آدام موسری: بودجه توکن هوش مصنوعی برای هر مهندس محدود می‌شود
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

نخستین بار است که یک مدیر ارشد در سطح متا، هزینهٔ مصرف توکن را مستقیماً با حقوق کارکنان مقایسه می‌کند و آن را به عنوان یک ریسک مالی جدی معرفی می‌کند.

تصور کنید مدیر مالی شرکت شما اعلام کند که حق استفاده از ابزارهای هوش مصنوعی شما، دقیقاً به اندازهٔ حقوق ماهیانه تان است و اگر بیشتر مصرف کنید، دسترسی‌تان قطع می‌شود. این سناریو دیگر یک شوخی نیست؛ بلکه واقعیت جدیدی است که متا برای مهندسانش پیش‌بینی می‌کند.

آدام موسری (Adam Mosseri)، رئیس اینستاگرام، در ۱۴ ژوئیه ۲۰۲۶ اعلام کرد که متا (Meta) برای حفظ نظم مالی، احتمالاً طی یک تا دو سال آینده سقف‌های سخت‌گیرانه‌ای برای مصرف توکن (Token) — یعنی تکه‌های کوچکی از متن، شبیه برش‌های یک کیک طولانی که مدل تکه‌تکه می‌خورد — وضع خواهد کرد. این تصمیم در حالی گرفته می‌شود که صنعت با هزینهٔ سرسام‌آور استنتاج (Inference) — لحظه‌ای که مدل واقعاً جواب تولید می‌کند و شبیه خودِ آشپزی است، نه دوره‌ی آموزش آشپز — دست‌وپنجه نرم می‌کند. این وضعیت بخشی از یک روند گسترده‌تر در صنعت است، چرا که برخی تحلیل‌ها نشان می‌دهند هزینه‌های سازمانی حتی با کاهش قیمت توکن‌ها در حال افزایش است.

همان‌طور که در تحلیل قبلی ما درباره‌ی هزینه‌های سخت‌افزاری مدل‌های بازمتن اشاره کردیم، چالش فعلی از خرید تراشه به مدیریت هزینهٔ هر پاسخ تغییر کرده است. بر اساس گزارش تک‌کرانچ (TechCrunch)، ابعاد این بحران مالی در غول‌های فناوری بسیار گسترده است:

  • متا اخیراً تابلوی امتیازات داخلی مصرف توکن را حذف کرد؛ چراکه این سیستم را یک «زباله‌دان توکن» می‌دانست که میلیاردها دلار هزینه می‌کرد اما هیچ ارزش واقعی ایجاد نمی‌کرد.
  • طبق گزارش‌ها، شرکت اوبر (Uber) تمام بودجهٔ سال ۲۰۲۶ خود برای کدنویسی با AI را تا ماه آوریل به پایان رسانده است. این شرکت پیش‌تر سقف هزینه‌ی ماهانه‌ی هر مهندس را تا ۱۵۰۰ دلار محدود کرده بود تا از اتلاف بودجه جلوگیری کند.
  • مایکروسافت (Microsoft) لایسنس‌های کلود کد (Claude Code) را لغو کرد تا مهندسانش را به ابزار داخلی Copilot CLI منتقل کند و هزینه‌ها را یکپارچه نماید.

به نقل از موسری، این بودجه‌ها احتمالاً بر اساس «بازگشت سرمایه» (ROI) مثبت تعریف می‌شوند. یعنی مهندسانی که ثابت کنند استفاده از مدل‌های استدلالی پیچیده باعث افزایش واقعی بهره‌وری شده‌اند، سقف مصرف بالاتری دریافت می‌کنند. این رویکرد مشابه استراتژی‌های سخت‌گیرانه‌ی دیگران است، مانند شرکت تسلا که سقف هزینه توکن‌های کارکنان خود را به ۲۰۰ دلار در هفته محدود کرد.

برای یک متخصص، این یعنی پایان دوران «آزمون و خطای رایگان». استفاده از AI از یک مزیت رفاهی به یک هزینهٔ عملیاتی (OpEx) تبدیل شده که توسط بخش مالی نظارت می‌شود.

مدیران اکنون روی جنگ قیمت‌ها میان سازندگان مدل‌ها شرط‌بندی کرده‌اند تا هزینه‌ها کاهش یابد. تا آن زمان، احتمالاً شاهد معرفی «سهمیه‌های توکن» در تمامی شرکت‌های بزرگ فناوری خواهیم بود.

گام بعدی شما

  • اگر در سازمان خود از AI استفاده می‌کنید، شروع به مستندسازی «ارزش خروجی» در برابر «تعداد درخواست‌ها» کنید.
  • مدل‌های کوچک‌تر و ارزان‌تر (SLM) را برای کارهای تکراری جایگزین مدل‌های سنگین کنید.
  • بودجهٔ احتمالی AI را در برنامه‌ریزی مالی سال آیندهٔ تیم خود بگنجانید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این گزارش با استناد به تجربه عملی متا، نشان می‌دهد که هزینه‌های استنتاج در مقیاس سازمانی همچنان یک مانع بزرگ است. این موضوع باعث می‌شود شرکت‌ها از مدل‌های عمومی به سمت مدل‌های تخصصی و کوچک‌تر حرکت کنند تا هزینه‌های عملیاتی را کنترل کنند.

تأثیر برای ایران

برای تیم‌های توسعه در ایران که با محدودیت بودجه ارزی برای خرید APIها مواجه‌اند، این خبر اهمیت دوچندان دارد. این روند، انگیزه برای استقرار مدل‌های محلی و متن‌باز (Self-hosting) را برای کاهش هزینه‌های دلاری افزایش می‌دهد.

·نگاه ما
تحریریه دات‌هوش

این تغییر رویکرد نشان می‌دهد که عصر «بهره‌وری رایگان» به پایان رسیده و AI وارد مرحلهٔ حسابرسی مالی شده است. وقتی هزینهٔ توکن با حقوق مهندس برابر می‌شود، فشار روی توسعه‌دهندگان برای بهینه‌سازی پرامپت‌ها (به جای مصرف کورکورانه) به‌شدت افزایش می‌یابد. احتمالاً شاهد ظهور ابزارهای نظارتی جدیدی باشیم که «به‌صرفه بودن» هر درخواست AI را پیش از ارسال بسنجند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.