
مدل MiniMax-Music3 آهنگهای پنجدقیقهای با وزنهای باز تولید میکند
شرکت MiniMax مدل MiniMax-Music3 را منتشر کرد که قادر است آهنگهای کامل پنجدقیقهای با کیفیت بالا از روی متن و شرح ساختار تولید کند. این مدل با معماری Hybrid-LM، تعادلی میان…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۶ مقاله منتشر شده

شرکت MiniMax مدل MiniMax-Music3 را منتشر کرد که قادر است آهنگهای کامل پنجدقیقهای با کیفیت بالا از روی متن و شرح ساختار تولید کند. این مدل با معماری Hybrid-LM، تعادلی میان…

یک تخصیصکننده جدید با جایگزینی زمانبندی FIFO، ظرفیتهای بلااستفاده GPU را بازیابی کرده و بهرهوری را در سناریوهای سنگین آموزش ۳۳ درصد بالا برده است. این سیستم با تبدیل تقاضای…

ترند اخیر «مهندسی گراف» که ادعا میکرد عصر حلقهها به پایان رسیده، در واقع از یک شوخی دربارهٔ عادت صنعت به تغییر نام مفاهیم قدیمی آغاز شد. در واقعیت، گرافها صرفاً تعمیمی از…

یک بنچمارک جامع روی ۱۵ مدل هوش مصنوعی نشان میدهد Step-3.5-Flash در سرعت پاسخدهی پیشتاز است، در حالی که Qwen3-8B بهترین موازنه میان قیمت و کارایی را دارد. این دادهها تأکید…

راهنمای جامع استفاده از کتابخانه docTR برای درک جامع اسناد از طریق ترکیب OCR، تحلیل چیدمان و استخراج اطلاعات کلیدی. این ابزار مسیر تبدیل متنهای خام به دادههای ساختاریافته و…

تستهای نرمافزاری سنتی به دلیل ماهیت احتمالی مدلهای زبانی برای عاملهای هوش مصنوعی ناکارآمد هستند. مهندسان باید از چارچوبهای ارزیابی چندبعدی متمرکز بر نتایج، قابلیت اطمینان و…

هسته جدید لینوکس ۷.۲ با معرفی Cache-Aware Scheduling، بهرهوری محاسبات هوش مصنوعی را افزایش و خطاهای حافظه CPU را کاهش داده است. لینوس توروالدز همچنین هشدار داد که حجم بالای…

پلتفرم Speko با معرفی یک مسیریاب هوشمند، هزینه سرویسهای STT را از طریق انتخاب پویا میان مدلهای مختلف کاهش داد. این سیستم با یک API واحد و سازگار با OpenAI، امکان جابهجایی میان…

سامانه AxiomProver موفق شد یکی از پیچیدهترین نتایج نظریه اعداد را بهصورت رسمی و ماشینخوان بازسازی کند. این دستاورد نشاندهنده گذار هوش مصنوعی از حل مسائل کوتاه مسابقاتی به…

میخال پیشچک با استفاده از کوانتش ترکیبی NVFP4 و بهینهسازیهای llama.cpp، مدل Qwen3.8 27B را با پنجره متنی ۲۵۶ هزار توکنی روی یک کارت گرافیک ۲۴ گیگابایتی مستقر کرد. این پیکربندی…

بیشتر عاملهای هوش مصنوعی تنها اشتباهات خود را «بازتاب» میکنند اما منطق زیربنایی خود را تغییر نمیدهند. متدولوژی جدید Wu Ji با جایگزینی رویکرد احتمالی با قوانین فیزیکی و گیتهای…

یک تست فشار روی سرورهای استنتاج رایگان نشان میدهد که تأخیر P95 بسیار سریعتر از میانگین زمان پاسخدهی تخریب میشود. این پدیده باعث ایجاد تایماوتهای بحرانی در خطوط تولید…