
پلتفرم FX100 توان عملیاتی استنتاج مدلهای زبانی را ۴۰٪ افزایش داد
شرکت Mingxin با معرفی معماری ذخیرهسازی لایهای برای KV Cache، گلوگاه حافظه در مدلهای با زمینه بلند را برطرف کرد. این رویکرد در مدلهای ۴۸۰ میلیارد پارامتری، زمان تا نخستین توکن…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۴۹ مقاله منتشر شده

شرکت Mingxin با معرفی معماری ذخیرهسازی لایهای برای KV Cache، گلوگاه حافظه در مدلهای با زمینه بلند را برطرف کرد. این رویکرد در مدلهای ۴۸۰ میلیارد پارامتری، زمان تا نخستین توکن…

پروتکل x402 با بازتعریف کد وضعیت ۴۰۲ در HTTP، امکان پرداخت لحظهای و خودکار برای هر فراخوانی API را برای عاملهای هوش مصنوعی فراهم میکند. این سازوکار نیاز به اشتراکهای ماهانه یا…

اوپنایآی مدل Astra را بهعنوان نخستین عضو خانواده GPT-6 معرفی کرد که بهجای تولید متن، بر تعامل سریع و خودمختار با نرمافزارها تمرکز دارد. این مدل در بنچمارکهای استدلال پیشرفت…

رگولاتورهای اروپا و سنگاپور برای تعیین مسئولیت قانونی عاملهای خودمختار در سیستمهای مالی، دو استراتژی متضاد را برگزیدند. در حالی که اروپا قوانین موجود را بسط میدهد، سنگاپور در…

آموزش فعلی مدلهای زبانی بر پایه پاداشهای تنبیهی است که منجر به ایجاد الگوهای «دلبستگی ناایمن» میشود. تغییر تعامل به سمت احترام و ترمیم رابطهای میتواند بهطور ریاضی مسیرهای…

شرکت Palladyne AI نرمافزار Palladyne IQ را در رباتهای صنعتی FANUC ادغام کرد تا جایگزین برنامهریزیهای صلب و قدیمی شود. این همکاری امکان یادگیری سریعتر و واکنش لحظهای رباتها…

تولید بازیابیافزا (RAG) با اتصال مدلها به دادههای بهروز و خصوصی در لحظه استنتاج، مانع از توهمات متقاعدکننده مدلهای ایستا میشود. این چارچوب با تفکیک بازیابی شواهد از تنظیم…

دستیارهای هوش مصنوعی با انتقال نفوذ برند به ابتدای مسیر خرید، مدلهای سنتی تحلیل بازاریابی را منسوخ میکنند. دادههای جدید نشاندهنده جهشی عظیم در ترافیک با نرخ تبدیل بالا است که…

پالانتیر با همکاری Nebius، امکان اجرای مدلهای وزنباز را در محیط امن سازمانی فراهم کرد. این اقدام به شرکتها اجازه میدهد بدون انتقال دادهها به ابرهای عمومی، از قدرت محاسباتی…

شرکت Neurologyca در حال توسعه لایهای برای درک سیگنالهای رفتاری انسان است تا عاملهای هوش مصنوعی بتوانند استرس و اعتمادبهنفس کاربر را تشخیص دهند. این شرکت معتقد است گلوگاه فعلی،…

بهینهسازی دسترسی به حافظه از طریق لایهبندی KV Cache، گلوگاه اصلی تأخیر در استنتاج مدلهای کوچک را برطرف کرد. بنچمارکهای جدید نشان میدهد که سختافزار Mingxin FX100 توان عملیاتی…

بنچمارکهای جدید Mingxin نشان میدهد جایگزینی NFS با آرایههای All-Flash مبتنی بر NVMe-oF، زمان بیکاری GPUها را در هنگام بارگذاری مدل بهشدت کاهش میدهد. این تغییر با بهینهسازی…