تصور کنید ابزاری در اختیار دارید که از هر چیزی در بازار سریعتر و دقیقتر کد میزند، اما هرگز اجازه ندارید آن را به مشتریان بفروشید. این دقیقاً وضعیتی است که مهندسان آنتروپیک (Anthropic) با مدل محرمانه خود تجربه میکنند.
به نقل از گزارش ریسک این شرکت در ۲۰ اوت ۲۰۲۶، مدلی با نام رمز Model 2 در حال اجراست که از تمام نسخههای عمومی کلود (Claude) قدرتمندتر است. این مدل که در ردهٔ کلاس Mythos قرار دارد، در حال حاضر فقط برای پژوهشهای داخلی و سیستمهای تولیدی استفاده میشود. همانطور که در تحلیل قبلی ما دربارهی استراتژیهای حفظ دادههای سازمانی در آزمایشگاههای AI اشاره کردیم، این رویکرد نشان میدهد که غولهای این صنعت اکنون مدلهای برتر خود را نه به عنوان محصول، بلکه به عنوان زیرساختهای اختصاصی میبینند.
این مدل اکنون عمیقاً در عملیات روزمره شرکت ادغام شده است. آنتروپیک برای نوشتن بخش بزرگی از کدهای سیستمهای تولیدی خود از Model 2 استفاده میکند. این کار از طریق عاملهای هوش مصنوعی (AI Agents) — شبیه به کارمندانی دیجیتال که بدون نیاز به نظارت لحظهای، وظایف پیچیده را از ابتدا تا انتها پیش میبرند — انجام میشود که بهصورت مداوم برای تولید داده و کارهای مهندسی فعال هستند. این اتکا به عاملهای خودکار در راستای گزارشات اخیر شرکت دربارهی نقش حیاتی این عاملها در بقای رقابتی است.
بر اساس مستندات شاخص قابلیتهای داخلی شرکت یا AECI، جزئیات فنی این مدل به شرح زیر است:
- Model 2 حدود ۱.۵ امتیاز بالاتر از Claude Mythos 5 قرار دارد.
- میزان این پیشرفت، کمتر از جهش قبلی (از نسخه Preview به Mythos 5) است.
- این مدل در مجموع قویتر است، هرچند در برخی حوزههای خاص همچنان ضعیفتر از نسخه عمومی عمل میکند.

از نظر ایمنی، آنتروپیک ریسک عدم همراستاسازی (Misalignment) را «پایین» ارزیابی کرده است. اگرچه این مدل پیش از استقرار مورد بررسی داخلی قرار گرفت، اما شرکت اعتراف میکند که Model 2 را به اندازه نسخه عمومی Mythos 5 آزمایش نکرده است. این ارزیابی در ادامه تغییر سطح ریسک عدم همراستاسازی مدلهای جدید این شرکت صورت گرفته است. با این حال، هیچ مورد نگرانکنندهای در این فرآیند کشف نشد.
این وضعیت شکافی عمیق میان «هوش مصنوعی مشتریمحور» و «هوش مصنوعی داخلی آزمایشگاهها» ایجاد کرده است. در واقع، آنتروپیک از یک هوش برتر برای ساخت ابزارهایی استفاده میکند که بعدها آنها را میفروشد؛ یک حلقه بازخوردی از بهرهوری که رقبایش برای بقا باید آن را شبیهسازی کنند.
گام بعدی شما
- اگر مدیر فنی هستید، بررسی کنید که آیا میتوانید بخشی از خط لوله کدنویسی خود را به مدلهای استدلالی بسپارید تا سرعت توسعه را افزایش دهید.
- منتظر گزارشهای مشابه از OpenAI باشید تا متوجه شوید چه مدلهای «سایهای» در پشت پرده صنعت فعال هستند.
- تفاوت عملکرد مدلهای داخلی و عمومی را به عنوان معیاری برای تخمین قدرت واقعی نسل بعدی مدلها در نظر بگیرید.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است — به تحلیل ما دربارهی تراشههای Blackwell مراجعه کنید.




گفتگو