اگر امروز برای ابزارهای کدنویسی هوش مصنوعی هزینه میپردازید، باید بدانید که ارزانترین گزینهها لزوماً ضعیفترین نیستند. مدل DeepSeek-V4-Flash-0731 در تقریباً تمام معیارهای حیاتی، از جمله هزینه و دقت بنچمارکها، مدل جدید مایکروسافت را شکست داد.
در ۱۲ اوت ۲۰۲۶، شرکت مایکروسافت مدل MAI Code 1.1 Flash را برای GitHub Copilot منتشر کرد و مدعی شد این مدل ۲۵٪ توکن-بهینهتر از نسخه ژوئن است. این مدل یک مدل زبانی کوچک (SLM) است؛ شبیه به یک دستیار متخصص که بهجای دانستن همه چیز، فقط روی یک مهارت خاص مثل کدنویسی تمرکز کرده تا سریعتر و ارزانتر باشد.
این عرضه در حالی رخ میدهد که مایکروسافت تلاش میکند خود را حامی هوش مصنوعی باز معرفی کند. با این حال، استراتژی داخلی این شرکت بهجای مدلهای با وزنهای باز (Open Weights) — یعنی مدلهایی که دستور پختشان علناً منتشر شده و هر کسی میتواند آنها را اجرا کند — به سمت مدلهای انحصاری و ارزانتر متمایل شده است. همانطور که در تحلیل قبلی ما دربارهی Microsoft BitNet و توانایی اجرای مدلهای ۱۰۰ میلیارد پارامتری روی یک CPU اشاره کردیم، مایکروسافت بهشدت روی کاهش هزینههای زیرساختی متمرکز شده است.
به گزارش وبسایت the-decoder.com، شکاف عملکردی بین این دو مدل بسیار عمیق است. در حالی که MAI Code 1.1 Flash توانسته مدلهای کوچک Anthropic و OpenAI را پشت سر بگذارد، اما در برابر کارایی DeepSeek کم آورده است:
- Terminal Bench 2.1: مدل DeepSeek امتیاز ۸۲.۷٪ را کسب کرد، در حالی که MAI Code 1.1 Flash به ۶۲.۹٪ رسید.
- SWE-bench Verified: مدل مایکروسافت با امتیاز ۷۲.۶٪، اندکی از Claude Haiku 4.5 (۶۹.۸٪) و GPT-5.4 mini (۶۹.۲٪) جلوتر بود.
- قیمتگذاری: هزینه ورودی DeepSeek هر توکن ۰.۱۴ دلار است، در حالی که برای مایکروسافت این رقم ۰.۲۰ دلار است. شکاف اصلی در هزینه خروجی است: ۰.۲۸ دلار برای DeepSeek در برابر ۱.۲۰ دلار برای مایکروسافت.
طبق بررسی مستندات، تصمیم مایکروسافت برای پنهان کردن این بنچمارکها در کارت مدل، نشاندهنده یک چرخش راهبردی به سمت افزایش حاشیه سود است. مایکروسافت با جایگزینی مدلهای شرکتهای ثالث با جایگزینهای داخلی MAI، وابستگی خود به تامینکنندگان خارجی را کم و هزینههای عملیاتی را کاهش میدهد.
برای کاربر نهایی، این یعنی تجربه پیشفرض در GitHub Copilot احتمالاً بهزودی مدلهای اقتصادی مایکروسافت را به گزینههای برتر بازار ترجیح میدهد. در واقع شما بخشی از دقت کدنویسی را فدای سود بیشتر مایکروسافت میکنید.
گام بعدی شما
- اگر هزینه استنتاج برایتان اولویت است، مدلهای DeepSeek را در گردشکارهای خود تست کنید.
- در تنظیمات Copilot بررسی کنید که آیا امکان تغییر مدل به نسخههای قدرتمندتر (غیر از Flash) وجود دارد یا خیر.
- تغییرات قیمتگذاری APIهای مایکروسافت را در ماه آینده زیر نظر بگیرید.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است — به تحلیل ما دربارهی تراشههای Blackwell مراجعه کنید.




گفتگو