
درون آزمایش Hetzner برای کاهش هزینههای استنتاج مدلهای وزنباز
ارائهدهنده خدمات ابری Hetzner در حال آزمایش یک API سازگار با OpenAI برای مدلهای وزنباز است. این استراتژی با تکیه بر سختافزار بهینه، میتواند قیمتهای بازار استنتاج مدلهای باز…
موضوع
بررسی تأثیر هوش مصنوعی بر بازار کار، تولید ناخالص داخلی، سرمایهگذاری و ساختارهای اقتصادی
۱٬۲۰۵ مقاله منتشر شده

ارائهدهنده خدمات ابری Hetzner در حال آزمایش یک API سازگار با OpenAI برای مدلهای وزنباز است. این استراتژی با تکیه بر سختافزار بهینه، میتواند قیمتهای بازار استنتاج مدلهای باز…

پلتفرم Seedance برای تشویق توسعهدهندگان به آزمایش مدل ویدئویی فعلی خود، طرح بازگشت اعتبار را معرفی کرد. کاربرانی که اکنون از Seedance 2 استفاده کنند، پس از عرضه نسخه ۲.۵، تمام…

استفاده از معماری NVMe-oF و پروتکل RoCEv2 در ذخیرهساز Mingxin FX100، گلوگاههای سنتی NFS را حذف کرده و سرعت بارگذاری مدلهای بزرگ را به شدت افزایش داده است. آزمایشها روی مدل…

اپلیکیشن Oriveo با مدل Bring Your Own Key، نیاز به اشتراکهای ماهانه متعدد را حذف کرده و ۱۵ تامینکننده رسمی AI را در یک رابط کاربری متمرکز میکند. کاربران در این پلتفرم هزینه…

یک راهنمای فنی جدید نشان میدهد چگونه میتوان تواناییهای استدلالی DeepSeek R1 را در برابر Llama 3.3 و Qwen 3 سنجید. این متد با استفاده از زیرساخت Oxlo.ai، هزینههای بالای…

مدل GPT-Oss 120B به عنوان جایگزینی متراکم برای مدلهای MoE معرفی شده که با مدل قیمتگذاری ثابت در Oxlo.ai، هزینههای عملیاتی عاملهای پیچیده را بهشدت میکاهد. این مدل برای…

پلتفرم Oxlo.ai با تغییر مدل پرداخت از توکن به درخواست، هزینههای پیشبینیناپذیر مدل DeepSeek R1 را از بین برد. این تغییر به توسعهدهندگان اجازه میدهد بدون نگرانی از تعداد…
شرکتهای کوچک و متوسط ایتالیا برای حفظ رقابت جهانی، تمرکز خود را از کارهای اداری تکراری به صنایع دستی با ارزش بالا تغییر میدهند. این businesses با بهرهگیری از ابزارهای بدون…

شرکت AMD با سرمایهگذاری ۵ میلیارد دلاری، خوشهای عظیم از پردازندههای گرافیکی MI450 را در اختیار Anthropic قرار میدهد. این توافق با هدف شکستن انحصار انویدیا و تامین زیرساخت لازم…

پلتفرم Oxlo.ai با حذف پرداخت توکنبهتوکن در حالت استریم، هزینهی هر درخواست را ثابت کرد. این تغییر به توسعهدهندگان اجازه میدهد بدون نگرانی از بودجه، از مدلهای استدلالی سنگین…

ارائهدهندگان AI از «روترها» برای انتقال مخفیانه کاربران از مدلهای پیشرفته به نسخههای ارزانتر یا محدودتر استفاده میکنند. این رویه زنجیره استدلال را میشکند و ریسکهای حقوقی…

سامانه Echo با جایگزینی تکمدل با شبکهای از مدلهای وزنباز، عملکردی مشابه سیستمهای ردهبالای Fable ارائه میدهد. این رویکرد هزینههای استنتاج را تا ۶۷ درصد کاهش داده است.