پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۷۲ مقاله منتشر شده

چرا Mistral برای شکست دادن رقبای MoE، دوباره به مدل‌های متراکم روی آورد؟

چرا Mistral برای شکست دادن رقبای MoE، دوباره به مدل‌های متراکم روی آورد؟

مدل Mistral Medium 3.5 با ۱۲۸ میلیارد پارامتر، مرز بین مدل‌های استدلالی و کدنویسی را از بین برد. این مدل متراکم، پایداری عملیاتی را جایگزین تخصص‌های پراکنده کرد تا یک ابزار…

۳ دقیقه خواندن۱
گزارش IBM: مدل ۸ میلیاردی Granite 4.1 مدل‌های ۳۲ میلیاردی MoE را شکست داد

گزارش IBM: مدل ۸ میلیاردی Granite 4.1 مدل‌های ۳۲ میلیاردی MoE را شکست داد

شرکت IBM با معرفی خانواده مدل‌های Granite 4.1 ثابت کرد که مهندسی دقیق داده می‌تواند جایگزین حجم عظیم پارامترها شود. مدل ۸ میلیارد پارامتری این مجموعه، با تکیه بر کیفیت داده،…

۳ دقیقه خواندن۲
راز ۱۵ درصدی Poolside برای شکستن سد هزینه‌های محاسباتی هوش مصنوعی

راز ۱۵ درصدی Poolside برای شکستن سد هزینه‌های محاسباتی هوش مصنوعی

شرکت Poolside AI با معرفی خانواده مدل‌های Laguna، ثابت کرد که بهره‌وری معماری می‌تواند جایگزین مقیاس خام شود. استفاده از بهینه‌ساز Muon و چارچوب AutoMixer، عملکرد مدل‌های کدنویسی…

۳ دقیقه خواندن۲
دگرگونی در تحلیل چندوجهی: Nemotron 3 و رکورد ۹ برابری سرعت در پردازش ویدئو

دگرگونی در تحلیل چندوجهی: Nemotron 3 و رکورد ۹ برابری سرعت در پردازش ویدئو

انویدیا با معرفی Nemotron 3 Nano Omni، استانداردهای تحلیل اسناد و ویدئو را جابه‌جا کرد. این مدل با معماری ترکیبی، کارایی را در پردازش‌های پیچیده تا ۹ برابر افزایش داده است.

۳ دقیقه خواندن
پایان توقف‌های شهودی: انویدیا مهندسی زیرزمینی را به یک حلقه بی‌وقفه تبدیل کرد
آموزش کاربردی

پایان توقف‌های شهودی: انویدیا مهندسی زیرزمینی را به یک حلقه بی‌وقفه تبدیل کرد

انویدیا با معرفی یک چارچوب **عامل‌محور** (Agentic)، توقف‌های تحلیل دستی در مهندسی زیرزمینی را حذف کرد. این سیستم با جایگزینی «جوخه‌های خودکار» به جای تحلیلگران انسانی، سرعت…

۳ دقیقه خواندن۲