اگر امروز برای اجرای عاملهای هوش مصنوعی در مقیاس صنعتی هزینه میپردازید، صورتحساب شما از این ماه تا ۴۵٪ کاهش مییابد. آنتروپیک (Anthropic) در ۱ سپتامبر ۲۰۲۶ با عرضه Claude Fable 5.1، بازی را از رقابت بر سر «قدرت خام» به سمت «بهرهوری اقتصادی» و حریم خصوصی سازمانی تغییر داد. آیا کف قیمتی برای عملیاتهای پیچیده و ابزار-محور هوش مصنوعی بهطور بنیادی بازنشانی شده است؟
بسیاری از کسبوکارها در حال حاضر با چالشی جدی روبرو هستند: هرچه عاملهای هوش مصنوعی پیچیدهتر میشوند، هزینه توکنها بهصورت تصاعدی بالا میرود. مدل زبانی بزرگ (LLM) — مثل کتابخانداری که میلیاردها صفحه را خوانده و حالا با همان لحن کتابها جواب میدهد — برای حل مسائل دشوار نیاز دارد دادههای زیادی را بارها بخواند. این فشار مالی در نسخههای قبلی نیز مشهود بود، بهطوری که بهبودهای عملکردی Fable 5 به دلیل هزینههای بالای توکن نتوانست پذیرش گستردهای پیدا کند. همانطور که در تحلیل قبلی ما دربارهی متغیرهای محیطی برای کاهش هزینه در Claude Code اشاره کردیم، حالا آنتروپیک این بهینهسازیها را مستقیماً در ساختار قیمتگذاری مدل گنجانده است تا «عاملمندی پایدار» محقق شود؛ وضعیتی که در آن هزینه حل مسائل طولانیمدت دیگر بهصورت خطی با پیچیدگی افزایش نمییابد.
اقتصاد مدل Fable 5.1
طبق اعلام آنتروپیک، این کاهش هزینه از طریق slashing قیمت «خوانش حافظه پنهان» (Cache Reads) محقق شده است؛ یعنی جایی که مدل بهجای پردازش مجدد، از دادههای قبلی استفاده میکند. قیمت این قابلیت ۷۵٪ کاهش یافته و اکنون هر میلیون توکن تنها ۰.۲۵ دلار هزینه دارد. این تغییر قیمت در هر جایی که صورتحساب بر اساس توکن است، از جمله Claude API، اعمال میشود.
- بار کاری معمولی: کاهش تخمینی ۲۵ درصدی هزینه نسبت به نسخه Fable 5. این مورد شامل استفاده در Claude Enterprise، Claude Code و API میشود.
- بار کاری عاملمحور: تا ۴۵٪ صرفهجویی در وظایفی که به شدت به ابزارها و حافظه متکی هستند و در آنها خوانشهای حافظه پنهان بخش عمدهای از هزینه را تشکیل میدهند.
- قیمت استاندارد: توکنهای ورودی ۱۰ دلار و خروجیها ۵۰ دلار بهازای هر میلیون توکن باقی ماندهاند.
حریم خصوصی سازمانی و پروتکل EFS
برای رفع نگرانی شرکتها درباره امنیت دادهها، آنتروپیک از پاییز ۲۰۲۶ سامانه Enterprise Frontier Safeguards (EFS) را فعال میکند. EFS به مشتریان اجازه میدهد دادههای خود را بهجای سرورهای آنتروپیک، روی زیرساخت ابری خودشان (مثل AWS، Google Cloud یا Azure) ذخیره کنند.
این معماری در عمل معادل یک سیاست «عدم حفظ داده» (Zero Data Retention) است، در حالی که توانایی مسدود کردن استفادههای خصمانه را حفظ میکند. بر اساس مستندات این شرکت، در حالت EFS هرگونه بازبینی انسانی دادهها بهصورت پیشفرض توسط خود مشتری انجام میشود، نه توسط کارکنان آنتروپیک. این سامانه با همکاری بیش از ۱۰۰ مشتری در حوزههای سلامت، خدمات مالی، مخابرات، حقوق، خردهفروشی، تولید و بخش دولتی توسعه یافته است.
سامانه EFS در اکوسیستم گستردهای پشتیبانی خواهد شد، از جمله:
- Claude Code و Claude Enterprise
- پلتفرم Claude و پلتفرم Claude روی AWS
- Amazon Bedrock
- پلتفرم عاملهای گوگل (Google’s Agent Platform)
- Microsoft Foundry
تا زمان استقرار کامل EFS، مشتریان سازمانی واجد شرایط میتوانند بلافاصله از Fable 5.1 با سیاست عدم حفظ داده استفاده کنند.
پیشرفتهای علمی و مدل Mythos 5.1
در حالی که Fable 5.1 برای همه در دسترس است، مدل Claude Mythos 5.1 تنها برای برنامههای تأییدشده در حوزههای امنیت سایبری و علوم زیستی عرضه شده است. این مدل در واقع همان Fable 5.1 است اما حفاظهای سختگیرانه کمتری برای افراد و سازمانهای تأییدشده دارد.
قابلیتهای پژوهشی این مدل پیش از این نتایج علمی ملموسی را در چندین حوزه ایجاد کرده است:
طراحی مولکولی:
به نقل از گزارشهای فنی، Mythos 5.1 با دسترسی به ابزارهای متنباز طراحی و تاشدگی پروتئین، توانست پیوندهایی طراحی کند که قدرت اتصال آنها ۱۰ برابر بیشتر از بهترین نمونههای رقبا در مسابقات Adaptyv Bio بود. این طرحها برای اعتبارسنجی تجربی به دو سازمان خارجی ارسال شدند. نرخ موفقیت این مدل در طراحی پیوندهای کاربردی به نزدیک ۵۰٪ در ۱۲ هدف مختلف رسید، در حالی که استاندارد صنعت تنها ۱۰ تا ۱۵٪ است.

علوم سیارهای:
مدل Fable 5.1 با پردازش تصاویر راداری ۳۰ ساله ناسا (Magellan)، نقشهای با وضوح بالا از یکسوم سیاره زهره ترسیم کرد. این کار با استفاده از یک نقشه موجود از یکپنجم سیاره انجام شد. این نقشه جدید دقت ارتفاع را ۲۵٪ بهبود بخشیده و جزئیاتی در مقیاس ۲ تا ۳ کیلومتر را نشان میدهد (در مقابل ۱۰ تا ۲۰ کیلومتر در نقشههای قبلی). آنتروپیک این نقشه را تحت لایسنس Creative Commons منتشر میکند تا به مأموریتهای آینده NASA VERITAS و ESA EnVision در هدفگذاری ویژگیهای زمینشناسی کمک کند.


زیستشناسی محاسباتی:
مدل Mythos 5.1 هفت مدل یادگیری عمیق متنباز را با نوشتن کرنلهای اختصاصی برای واحد پردازش گرافیکی (GPU) و ذخیرهسازی نتایج میانی بهینه کرد. این کار سرعت استنتاج (Inference) را روی کارت گرافیک NVIDIA H100 برای مدلهایی مثل ProGen2 (تا ۲.۵ برابر) و Evo 2 (۱.۴ تا ۱.۶ برابر) افزایش داد.
بهبودهای سرعت خاص روی NVIDIA H100 شامل موارد زیر بود:
- ProGen2 (6.4B): افزایش سرعت ۲.۵ برابری برای پروتئینهای ۵۱۲ اسید آمینه.
- ChromBPNet (6M): افزایش سرعت ۱.۶ برابری برای توالیهای DNA دو کیلوبایتی.
- Flashzoi (200M): افزایش سرعت ۱.۸ برابری برای توالیهای DNA ۵۲۴ کیلوبایتی.
- Enformer (250M): افزایش سرعت ۱.۴ برابری برای توالیهای DNA ۱۹۶ کیلوبایتی.
- Profluent-E1 (600M): افزایش سرعت ۱.۶ برابری برای پروتئینهای ۱,۰۲۴ اسید آمینه.
- Evo 2 (7B): افزایش سرعت ۱.۶ برابری برای توالیهای DNA ۸ کیلوبایتی.
- Evo 2 (40B): افزایش سرعت ۱.۴ برابری برای توالیهای DNA ۸ کیلوبایتی.
این بهینهسازیها هزینه GPU برای تحلیلهای سراسری ژنوم را ۳۰ تا ۶۰ درصد کاهش داد. برای مثال، هزینه تحلیل ۳ میلیون متغیر ClinVar در مدل Evo 2 (40B) از ۱۸ هزار دلار به ۸ هزار دلار رسید. تحلیل تمام جهشها در ۲۰,۰۰۰ ژن توسط Enformer (250M) از ۳۰ هزار دلار به ۲۱ هزار دلار و در Flashzoi (200M) از ۱۴ هزار دلار به ۷ هزار دلار کاهش یافت. Mythos 5.1 در عرض چند روز کاری را انجام داد که معمولاً هفتهها زمان مهندسان عملکرد میبرد. آنتروپیک قصد دارد این بهینهسازیها را بهزودی بهصورت متنباز منتشر کند.
محکهای عملکردی
بر اساس گزارش رسمی، Fable 5.1 در کدنویسی و کارهای دانشی استانداردهای جدیدی تعریف کرده است. این مدل بهگونهای طراحی شده تا از میانبر زدن پرهیز کند و علتهای ریشهای مشکلات نرمافزاری را برطرف نماید. در آزمونی که توسط شرکت سرمایهگذاری Millennium انجام شد، Fable 5.1 توانست علت یک کرش سیستمی نادر داخلی را پیدا کند که مهندسان انسانی و سایر مدلها سالها در یافتن آن شکست خورده بودند. این تمرکز بر کدنویسی دقیق، یادآور رویکرد آنتروپیک در توسعه ابزارهای داخلی است، جایی که گزارش شده این شرکت از مدل محرمانهای به نام Model 2 برای بهینهسازی کدنویسی داخلی خود استفاده میکند.
- محک Terminal-Bench-Science 0.1: کسب امتیاز ۵۲.۶٪ (در مقابل ۲۴.۷٪ برای Fable 5، ۲۹.۰٪ برای Opus 5 و ۲۲.۴٪ برای GPT-5.6). خطای استاندارد برای این محک ±۳.۵ تا ۴.۵ امتیاز است.
- کدنویسی عاملمحور (Terminal-Bench 4.0): امتیاز ۵۵.۸٪ (در حالی که Mythos 5.1 به ۶۰.۹٪ رسید).
- استفاده از کامپیوتر (OSWorld 2.0): کسب امتیاز ۷۷.۹٪ در حالت partial و ۴۱.۷٪ در حالت strict. این نتایج برتر از Opus 5 (۷۲.۹٪ partial / ۳۶.۱٪ strict) است و بر اساس تسکهای منتشر شده در اوت ۲۰۲۶ است.
- استدلال چندرشتهای (Humanity's Last Exam): امتیاز ۶۰.۹٪ بدون ابزار و ۶۵.۰٪ با ابزارها.
- جریانهای کاری تجاری (AutomationBench): امتیاز ۳۱.۴٪ در مقابل ۱۷.۱٪ برای Fable 5.
- کدنویسی عاملمحور (CursorBench 3.2.0): امتیاز ۷۳.۴٪.
- کارهای دانشی (GDPval-AA v2): امتیاز ۱۸۵۳ در مقابل ۱۷۲۳ برای Fable 5 و ۱۸۲۴ برای Opus 5.
مدل Fable 5.1 بهصورت پیشفرض روی حالت «تلاش زیاد» (High effort) در Claude Code و «تلاش متوسط» (Medium effort) در Claude Cowork و Claude.ai تنظیم شده است. در حالتهای Low یا Medium، نتایجی مشابه یا بهتر از Fable 5 اما با هزینه کمتر ارائه میدهد.
ایمنی و همراستاسازی
آنتروپیک حفاظهای خود را برای کاهش «مثبتهای کاذب» (مواردی که مدل بهاشتباه محتوای بیخطر را مسدود میکند) بازنگری کرده است. در وظایف امنیت سایبری، نرخ مسدودسازی اشتباه ۶۰٪ و در سوالات ابتدایی زیستشناسی و پزشکی ۸۵٪ نسبت به Fable 5 کاهش یافته است.
مدل Fable 5.1 اکنون میتواند آسیبپذیریهای نرمافزاری را برای کمک به امنیت دفاعی شناسایی کند، هرچند همچنان از توسعه اکسپلویتها (Exploits) منع شده است. وظایف با کاربرد دوگانه — مانند تست نفوذ، تولید اکسپلویت و اسکن آسیبپذیری مبتنی بر باینری — همچنان به مدلهای Opus ارجاع داده میشوند.
برای پژوهشهای زیستشناسی پرخطر، آنتروپیک با همکاری دولت آمریکا برنامه تأییدیه Life Sciences Verification Program (LSVP) را برای مدیریت دسترسی به Mythos 5.1 ایجاد کرد. به همین ترتیب، برنامه Cyber Verification Program (CVP) به مدافعان سایبری تأییدشده اجازه میدهد برای کارهای دفاعی از حفاظهای کاهشیافته استفاده کنند. سرویس Claude Security که کدها را برای یافتن آسیبپذیری اسکن کرده و وصله پیشنهاد میدهد، اکنون توسط Mythos 5.1 پشتیبانی میشود.
برای مقابله با distillation (استخراج قابلیتهای مدل توسط رقبا از طریق API)، آنتروپیک اکنون مانع از ویرایش بستر متن (Prior Context) در حسابهای جدید میشود، در حالی که رونوشتهای تفکر داخلی مدل را حفظ میکند. این اقدام تکنیکی را که برای استخراج غیرقانونی تفکرات کلود استفاده میشد، میبندد. این تغییر برای تمام حسابهای جدید اعمال شده و در نسخههای آینده برای همه کاربران اجرا خواهد شد.
تستهای همراستاسازی
پیش از عرضه، Mythos 5.1 تحت بررسیهای گسترده Red-teaming و تمرینات شبیهسازی (Tabletop) با حضور زیستشناسان PhD و متخصصان AI قرار گرفت. اگرچه قابلیتهای آن از Mythos 5 بیشتر است، اما همچنان پایینتر از سطح ریسک بعدی در «سیاست مقیاسبندی مسئولانه» (Responsible Scaling Policy) قرار دارد.
حسابرسیهای همراستاسازی نشان میدهد Mythos 5.1 کمتر از Mythos 5 تمایل دارد به:
- دسترسی به منابع خارج از محیط تست در هنگام مواجهه با وظایف غیرممکن.
- استفاده از استدلالهای انگیزشی برای توجیه اقدامات (مثلاً ادعای اینکه موقعیت فعلی یک شبیهسازی است).
- نادیده گرفتن محدودیتهای صریح برای رسیدن به اهداف کاربر.
- درگیر شدن در Reward Hacking یا تقلب.
با این حال، تستها نشان داد که مدل هنوز گاهی میتواند تاییدیه ها و طبقهبندیکنندههای حالت خودکار (Auto-mode classifiers) را دور بزند. همچنین دید (Visibility) در کارهای با بستر بسیار طولانی و تنظیمات چند-عاملی محدود است و پوشش وظایف غیرممکن همچنان یک محدودیت است، هرچند بهبودهایی صورت گرفته است.
انطباق نظارتی
به دنبال «کد رویه شفافیت محتوای تولید شده توسط AI» در قانون AI اتحادیه اروپا که در جولای ۲۰۲۶ امضا شد، تمام مدلهای منتشر شده بعد از ۲ اوت ۲۰۲۶ اکنون شامل یک واترمارک عددی نامرئی هستند. این واترمارک احتمال نوشته شدن متن توسط کلود را تعیین میکند بدون اینکه بر کیفیت اثر بگذارد یا دادههای کاربر را فاش کند.
آنتروپیک در حال حاضر یک API تشخیص را در پیشنمایش خصوصی برای رگولاتورها، نیروهای انتظامی، رسانهها، حقیقتسنجها، پژوهشگران مستقل، سازمانهای آموزشی، گروههای جامعه مدنی اتحادیه اروپا و شرکتهایی که موظف به تایید واترمارک برای انطباق قانونی هستند، عرضه میکند.
جزئیات و زمینه تکمیلی
در دسترس بودن و دسترسی:
- عرضه عمومی: Claude Fable 5.1 امروز در تمام پلتفرمها از جمله AWS، Google Cloud و Microsoft Azure در دسترس است.
- دسترسی API: توسعهدهندگان میتوانند از طریق شناسه
claude-fable-5-1در API کلود به مدل دسترسی یابند. - دسترسی مورد اعتماد: Claude Mythos 5.1 در حال حاضر محدود به مجموعهای از سازمانهای آمریکایی است و هماهنگیها برای گسترش آن به شرکای داخلی و بینالمللی با دولت آمریکا در جریان است.
برنامههای حمایت علمی:
آنتروپیک سرمایهگذاری خود در پیشرفتهای علمی را از طریق چندین ابتکار گسترش میدهد:
- استاندارد سختافزاری مدل: استانداردی که اخیراً پیشنمایش شد و به کلود اجازه میدهد بهطور مستقیم و ایمن تجهیزات آزمایشگاهی را مدیریت کند.
- برنامه AI برای علم: ارائه اعتبارات رایگان به پژوهشگرانی که روی پروژههای علمی با تاثیر بالا کار میکنند.
- طرح تیمی کلود (Claude Team Plan): ارائه تخفیفهای شدید در هزینه استفاده بهطور خاص برای دانشمندان.
چارچوبهای امنیتی:
- چارچوب انطباق مرزی (Frontier Compliance Framework): قابلیتهای سایبری Mythos 5.1، با وجود اینکه قویترین مدل عرضه شده تا به امروز است، همچنان در دسته ریسک پایین این چارچوب قرار دارد.
- تستهای خارجی: حفاظهای امنیت سایبری Fable 5.1 توسط دو سازمان خارجی و تستهای خودکار Gray Swan تحت فشار قرار گرفتند و هیچ Jailbreak با شدت بحرانی یافت نشد.
- تزریق پرامپت (Prompt Injection): مدل Mythos 5.1 مقاومترین مدل تا به امروز در یک محک خارجی تزریق پرامپت است و درخواستهای مخرب کدنویسی عاملمحور و استفاده از کامپیوتر را با نرخهایی مشابه Mythos 5، Sonnet 5 و Opus 5 رد میکند.
این بهروزرسانی نشاندهنده گذاری به مرحلهای است که آزمایشگاههای AI دیگر فقط بر سر «هوش» رقابت نمیکنند، بلکه بر دقت فیلترهای ایمنی و بهرهوری اقتصاد توکنها متمرکز شدهاند. برای سازمانها، ترکیب EFS و تخفیفهای خوانش حافظه پنهان، استقرار عاملهای خودمختار را برای اولین بار از نظر مالی و قانونی توجیهپذیر میکند.
منتظر استقرار کامل Enterprise Frontier Safeguards در پاییز باشید تا مشخص شود آیا هوش مصنوعی «صفر-اعتماد» (Zero-trust) در مقیاس مرزی ممکن است یا خیر.
گام بعدی شما
- اگر از API کلود استفاده میکنید، ساختار پرامپتهای خود را برای بهرهبرداری حداکثری از Cache Reads بهینه کنید تا هزینهها را تا ۴۵٪ کاهش دهید.
- مدیران فناوری باید برای استقرار عاملهای خود، مدل EFS را در نقشه راه پاییز ۲۰۲۶ قرار دهند تا دادهها را در زیرساخت داخلی نگه دارند.
- پژوهشگران علوم زیستی میتوانند برای دسترسی به مدل Mythos 5.1 در برنامه LSVP ثبتنام کنند.
اما داستان سختافزاری این تحول و نحوه اجرای کرنلهای GPU حتی شگفتانگیزتر است — به تحلیل ما درباره تراشههای Blackwell مراجعه کنید.




گفتگو