
Oxlo.ai: کاهش شدید هزینههای استنتاج با مدل متراکم ۱۲۰ میلیارد پارامتری
مدل GPT-Oss 120B به عنوان جایگزینی متراکم برای مدلهای MoE معرفی شده که با مدل قیمتگذاری ثابت در Oxlo.ai، هزینههای عملیاتی عاملهای پیچیده را بهشدت میکاهد. این مدل برای…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۱۰۵ مقاله منتشر شده

مدل GPT-Oss 120B به عنوان جایگزینی متراکم برای مدلهای MoE معرفی شده که با مدل قیمتگذاری ثابت در Oxlo.ai، هزینههای عملیاتی عاملهای پیچیده را بهشدت میکاهد. این مدل برای…

پلتفرم Oxlo.ai با تغییر مدل پرداخت از توکن به درخواست، هزینههای پیشبینیناپذیر مدل DeepSeek R1 را از بین برد. این تغییر به توسعهدهندگان اجازه میدهد بدون نگرانی از تعداد…

صنعت تولید متن از مدلهای متراکم به سمت معماری ترکیب خبرهها (MoE) میرود تا توان استدلالی و پنجرههای متنی بزرگ را بدون هزینههای سرسامآور حفظ کند. این تغییر اجازه میدهد…

پلتفرم Oxlo.ai با حذف پرداخت توکنبهتوکن در حالت استریم، هزینهی هر درخواست را ثابت کرد. این تغییر به توسعهدهندگان اجازه میدهد بدون نگرانی از بودجه، از مدلهای استدلالی سنگین…

سامانه Echo با جایگزینی تکمدل با شبکهای از مدلهای وزنباز، عملکردی مشابه سیستمهای ردهبالای Fable ارائه میدهد. این رویکرد هزینههای استنتاج را تا ۶۷ درصد کاهش داده است.

اوپنایآی قابلیتهای سلامتی ChatGPT را برای تمامی کاربران بالای ۱۸ سال در آمریکا فعال کرد تا امکان تحلیل پروندههای پزشکی فراهم شود. این گسترش در حالی رخ میدهد که شرکت با شکایتی…

اتکای به فایلهای دستورالعمل برای کنترل رفتار عاملها ناکارآمد است زیرا مدلها ادعای پیروی میکنند بدون آنکه واقعاً بررسی شود. امنیت واقعی نیازمند انتقال کنترل از متن به لایهی…

تحلیلهای تخصصی نشان میدهد کارخانههای نرمافزاری «بدون نظارت انسانی» شکست میخورند، زیرا آموزشهای فعلی مدلها، عبور از تستها را بر حفظ کیفیت بلندمدت کد اولویت میدهند. راهکار…

پلتفرم Typebulb ابزاری برای تحلیل «اثرانگشت نویسندگی» ۲۲ مدل زبانی بزرگ معرفی کرد که شباهتهای سبکشناختی مدلهای آزمایشگاههای مختلف را میسنجد. این تحلیل نشان میدهد که مدلهای…

معماری جدیدی پیشنهاد شده که لایهای از استدلال هوش مصنوعی را به خطوط لوله CI/CD اضافه میکند تا ریسکهای زمینهای مانند حذفهای خطرناک SQL را شناسایی کند. این رویکرد با ترکیب…

آنتروپیک یک افزونه امنیتی بتا برای Claude Code معرفی کرد که با استفاده از یک خط لوله ششمرحلهای و پنلهای تأیید تخاصمی، مخازن کد را برای یافتن آسیبپذیریها اسکن میکند. این…

پلتفرم AIBridge مدل استدلالی Kimi K3 را با پنجره متنی عظیم یک میلیون توکنی ادغام کرد تا تحلیل کل کدهای یک پروژه در یک پرامپت ممکن شود. همچنین برای کاهش اصطکاک در ثبتنام، سیستم…