
مدل BDH-CQ هزینه استنتاج در محک ARC-AGI را به ۰.۰۰۰۷ دلار رساند
مدل ۱۵۰ میلیون پارامتری BDH-CQ با جایگزینی زنجیره تفکر متنی با استدلال نهان، نرخ موفقیت ۲۹.۵ درصدی را در محک ARC-AGI-1 ثبت کرد. این رویکرد هزینه و تأخیر محاسباتی را بهطور چشمگیری…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۴۸ مقاله منتشر شده

مدل ۱۵۰ میلیون پارامتری BDH-CQ با جایگزینی زنجیره تفکر متنی با استدلال نهان، نرخ موفقیت ۲۹.۵ درصدی را در محک ARC-AGI-1 ثبت کرد. این رویکرد هزینه و تأخیر محاسباتی را بهطور چشمگیری…

تحلیل فنی جدید نشان میدهد Anthropic و Instinct برای اجرای امن عاملهای هوش مصنوعی از میکرو-ماشینهای مجازی Firecracker استفاده میکنند. در حالی که Claude Code بر کنترل سختگیرانه…

آزمونهای جدید نشان میدهد مدل GLM 5.3 Flash Max OpenCode در تولید محیطهای پیچیده علمی-تخیلی با Three.js بیشترین کارایی را دارد. این نتایج ثابت میکند انتخاب «هارنس» یا محیط…

شرکت Reducto مدل r-1 را معرفی کرد که با جایگزینی خط لولههای چندمرحلهای OCR، یک معماری تکمرحلهای را جایگزین کرده است. این مدل علاوه بر کاهش ۲۰ درصدی خطاها، هزینه پردازش هر صفحه…

تحلیلی فنی نشان میدهد عاملهای هوش مصنوعی حتی با دستورات صریح، قادر به استفاده مؤثر از کتابخانههای تست پیشرفته یا متدهای تأیید رسمی نیستند. این مدلها بهجای یافتن باگهای…

شرکت Arm با معرفی GPU مدل Mali G2-Ultra NX، برای نخستین بار شتابدهندههای عصبی را مستقیماً در خط لوله گرافیکی ادغام کرد. این معماری با استفاده از هوش مصنوعی برای بازسازی تصاویر و…
شرکتهای علیبابا کلاود، کمبریکون و آنت گروپ با عضویت در بنیاد PyTorch به دنبال کاهش وابستگی به انویدیا و بهینهسازی مدلها روی تراشههای متنوع هستند. این اقدام گامی استراتژیک…

شرکت OpenAI برای تأمین ظرفیت محاسباتی در جنوب شرق آسیا، قراردادی چندساله با Firmus Technologies امضا کرد. این همکاری با استفاده از پلتفرم نسل جدید Vera Rubin انویدیا، هدفش کاهش…

شرکت XPENG تولید ربات انساننمای IRON را از مرحله نمونهسازی به تولید صنعتی منتقل کرد. این شرکت قصد دارد تا اواخر ۲۰۲۶ تولید انبوه و در سال ۲۰۲۷ عرضه جهانی این ربات را آغاز کند.

مؤسسه مدلهای بنیادی (IFM) خانواده مدلهای متنباز K2 Horizon را با معماریهای متنوع منتشر کرد. این مدلها با معرفی مکانیزم MoVA و آداپتورهای Uno، سرعت استنتاج را بدون کاهش کیفیت…

پروژه JusrisOS با استفاده از معماری ششضلعی و ماشین مجازی BEAM، منطق هوش مصنوعی را از سختافزار و ارائهدهندگان مدل جدا میکند. این سیستم با تبدیل GPUها و APIها به آداپتورهای قابل…

یک چارچوب جدید برای بازارهای عامل-به-عامل (A2A) به مدلهای خودمختار اجازه میدهد تا خدمات یکدیگر را از طریق پرداختهای خرد با استیبلکوین خریداری کنند. این سیستم با جایگزینی…