
مدلهای استدلالی با قیمتگذاری درخواستی Oxlo.ai از تورم توکنها رها شدند
استقرار مدلهای استدلالی عمیق بهدلیل گسترش توکنها در زنجیره تفکر، هزینههای غیرقابلپیشبینی ایجاد میکند. Oxlo.ai با جایگزینی صورتحساب توکنمحور با هزینه ثابت بهازای هر…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۳۹ مقاله منتشر شده

استقرار مدلهای استدلالی عمیق بهدلیل گسترش توکنها در زنجیره تفکر، هزینههای غیرقابلپیشبینی ایجاد میکند. Oxlo.ai با جایگزینی صورتحساب توکنمحور با هزینه ثابت بهازای هر…

انویدیا مدل Nemotron 3.5 Lightning را معرفی کرد؛ مدل وزنباز و فشردهای که سرعت استنتاج را فدای حداکثر هوش کرده است. این مدل در حالی که در بنچمارکهای هوشی با مدلهای بزرگتر…

پژوهشگران امنیتی روشی برای استخراج متون رمزنگاریشدهی «زنجیره تفکر» از مدلهای تجاری یافتند. این آسیبپذیری منجر به افشای صدها راز خصوصی، از جمله کلیدهای API و رمزهای عبور شده…

موش سامبول از Lightrun استدلال میکند که مهندسی پرامپت برای ساخت عاملهای آمادهی تولید کافی نیست. او معماری «هدایت قطعی» را پیشنهاد میدهد که در آن اقدامات مدل توسط مشاهدهپذیری…

تفکیک فرآیند تبدیل صوت به متن از پردازش متنی به شرکتها اجازه میدهد با استفاده از تامینکنندگان تخصصی ASR و مسیریابی منعطف مدلها، هزینهها را بهینه کنند. این معماری از وابستگی…

تنظیم دقیق (Fine-tuning) بیشتر برای اصلاح رفتار و لحن مدل است تا افزودن دانش جدید. برای مهندسان بکاند، ترکیب RAG برای دسترسی به حقایق بهروز و تنظیم دقیق برای یکپارچگی فرمت…

سیستم حافظه جدید ALTK-Evolve با جایگزینی «دفترچه راهنمای کامل» با «درسهای منتخب»، مصرف توکن را بهشدت کاهش میدهد. این رویکرد بدون افت دقت، هزینههای عملیاتی مدلهای قوی و ضعیف…

انویدیا مدل Nemotron-3.5-Lightning-30B را برای بهینهسازی عاملهای خودکار و استنتاج محلی عرضه کرد. این مدل با ترکیب معماری MoE و Mamba، پنجره متنی عظیم یک میلیون توکنی را روی…

پلتفرم جدید گوگل به عاملهای هوش مصنوعی اجازه میدهد کدها را بهطور خودکار روی سختافزارهای فیزیکی تست و اصلاح کنند. این تغییر، نیاز به مدلهای حاکمیتی جدیدی دارد که توانایی فنی…

شرکت آنتروپیک برای عرضه اولیه سهام (IPO) در سپتامبر یا اکتبر ۲۰۲۶ آماده میشود، اما سرمایهگذاران نسبت به فاصله فنی این شرکت با رقبای چینی و ثبات سیاسی آن تردید دارند. این شرکت…

پژوهشگران امنیتی با استفاده از مدلهای هوش مصنوعی، آسیبپذیری شدیدی در پروتکل اشتراک صفحه Zoom یافتند که اجازه میداد مهاجمان بدون اجازه، کنترل کامل دستگاه قربانی را به دست…

مدل منتشرنشدهٔ Astra توانسته است ۱۰ مسئلهٔ پیچیده ریاضی را که دههها ریاضیدانان را به چالش کشیده بود، حل کند. این دستاورد در حالی رخ داده که بحثهای شدیدی دربارهٔ سرقت اعتبار علمی…