پرش به محتوای اصلی
پرش به محتوای مقاله

کاهش ۴۵ درصدی هزینهٔ اجرای عامل‌های هوش مصنوعی در Claude Fable 5.1

·۱۱ شهریور ۱۴۰۵۲ دقیقه مطالعه
عذرخواهی آنتروپیک بابت قیود نامرئی کلود فیبل
عذرخواهی آنتروپیک بابت قیود نامرئی کلود فیبل
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر مدل قیمت‌گذاری برای داده‌های کش‌شده که منجر به کاهش ۴۵ درصدی هزینه در گردش‌کارهای تکراری شد؛ در حالی که نسخه‌های قبلی بر افزایش دقت تمرکز داشتند، این نسخه بر کاهش هزینه استنتاج متمرکز است.

اگر امروز برای اجرای عامل‌های هوش مصنوعی هزینه می‌پردازید، صورت‌حساب شما در مدل جدید تا ۴۵٪ ارزان‌تر می‌شود. آنتروپیک (Anthropic) در ۱ سپتامبر ۲۰۲۶ این به‌روزرسانی را برای پاسخ به اعتراضات کاربران درباره قیمت‌ها و فیلترهای سخت‌گیرانهٔ ایمنی منتشر کرد.

این چرخش به سمت بهره‌وری در حالی رخ می‌دهد که صنعت هنوز با کاربردی بودن واقعی عامل‌های خودمختار دست‌وپنجه نرم می‌کند. همان‌طور که در تحلیل قبلی ما درباره‌ی نرخ پایین استفاده از عامل‌های سفارشی اشاره کردیم، این کاهش قیمت تلاشی است تا موانع مالی توسعه‌دهندگان برای نگه داشتن عامل‌ها در محیط عملیاتی برداشته شود. در واقع، عامل (Agent) — شبیه به کارمندی دیجیتال که می‌تواند به‌جای شما ابزارها را مدیریت کند و تصمیم بگیرد — اکنون با هزینه‌ای بسیار کمتر در دسترس است.

طبق گزارش ورج (The Verge)، این کاهش هزینه از قیمت‌گذاری جدید برای داده‌های کش‌شده (Cached Data) حاصل شده است؛ یعنی داده‌هایی که مدل پیش‌تر پردازش کرده و حالا دوباره به آن‌ها نیاز دارد. جزئیات فنی این نسخه به شرح زیر است:

  • Claude Fable 5.1: در تمام پلتفرم‌ها در دسترس است و برای کدنویسی و حل مسائل طولانی‌مدت بهینه شده است.
  • Claude Mythos 5.1: فعلاً محدود به شرکت‌کنندگان پروژه Glasswing است و در تنظیمات پایین، عملکرد مدل قبلی را حفظ کرده است.
  • محک‌های علمی: بر اساس داده‌های simonwillison.net، مدل Fable 5.1 در آزمون Terminal-Bench-Science 0.1 امتیاز ۵۲.۶٪ را کسب کرد که به‌طور چشمگیری از امتیاز ۲۲.۴٪ مدل GPT-5.6 Sol پیشی گرفته است.

آرون لویی، مدیرعامل باکس (Box)، گزارش داده است که Fable 5.1 ابهامات داده‌ای را شناسایی می‌کند که نسخه قبلی نادیده می‌گرفت. همچنین این مدل اکنون اجازه شناسایی آسیب‌پذیری‌های نرم‌افزاری را می‌دهد، هرچند تولید اکسپلویت‌های پرخطر همچنان محدود به مدل‌های Opus است.

برای کاربران تجاری، این یعنی «مالیات توکن» برای عامل‌های چندمرحله‌ای در حال کاهش است. با ارزان‌تر شدن حافظه، اکنون استقرار عامل‌هایی که حافظه عمیقی از یک پروژه دارند، بدون ورشکست کردن اپراتور، توجیه اقتصادی دارد.

گام بعدی شما

  • اگر از گردش‌کارهای پیچیده استفاده می‌کنید، مدل Fable 5.1 را جایگزین نسخه‌های قبلی کنید تا هزینه استنتاج را کاهش دهید.
  • در صورت نیاز به تحلیل‌های علمی دقیق، خروجی‌های این مدل را با GPT-5.6 مقایسه کنید.
  • منتظر انتشار Enterprise Frontier Safeguards در پاییز باشید تا داده‌هایتان را در ابر شخصی خودتان ذخیره کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این اقدام با تکیه بر اعتبار فنی آنتروپیک در بهینه‌سازی استنتاج، مدل‌های عامل‌محور را از محیط آزمایشگاه به محیط تولید تجاری می‌برد. کاهش هزینه، مانع اصلی استقرار گسترده AI Agents در سازمان‌های بزرگ را از بین می‌برد.

تأثیر برای ایران

به‌دلیل محدودیت‌های API و تحریم‌ها، دسترسی مستقیم توسعه‌دهندگان ایرانی به این مدل‌ها دشوار است، اما کاهش هزینه استنتاج در سطح جهانی، قیمت سرویس‌های واسط (Proxy) را در بازار ایران کاهش می‌دهد.

·نگاه ما
تحریریه دات‌هوش

تمرکز آنتروپیک بر کاهش هزینه به‌جای افزایش صرفِ قدرت، نشان می‌دهد که رقابت مدل‌های زبانی از مرحله «نمایش توانایی» به مرحله «پایداری اقتصادی» رسیده است. کاهش هزینه کش، در واقع پذیرشی از این واقعیت است که عامل‌های کاربردی به پنجره‌های متنی عظیم و تکراری نیاز دارند و مدل‌های فعلی در مدیریت هزینه این تکرارها شکست خورده بودند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.