پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۴۱۸ مقاله منتشر شده

فراتر از پیکسل‌ها؛ نقشه‌ی Runway برای تسخیر دنیای فیزیکی

فراتر از پیکسل‌ها؛ نقشه‌ی Runway برای تسخیر دنیای فیزیکی

مدیرعامل Runway معتقد است تولید ویدیو تنها پیش‌درآمدی برای خلق «مدل‌های جهان» است که واقعیت فیزیکی را شبیه‌سازی می‌کنند. این چرخش استراتژیک، هدف شرکت را از ابزارهای سینمایی به سمت…

۲ دقیقه خواندن
چرا Mistral برای شکست دادن رقبای MoE، دوباره به مدل‌های متراکم روی آورد؟

چرا Mistral برای شکست دادن رقبای MoE، دوباره به مدل‌های متراکم روی آورد؟

مدل Mistral Medium 3.5 با ۱۲۸ میلیارد پارامتر، مرز بین مدل‌های استدلالی و کدنویسی را از بین برد. این مدل متراکم، پایداری عملیاتی را جایگزین تخصص‌های پراکنده کرد تا یک ابزار…

۳ دقیقه خواندن۱
رمزگشایی از Join the chat: وقتی آمازون فروشنده را با صدا جایگزین می‌کند
آموزش کاربردی

رمزگشایی از Join the chat: وقتی آمازون فروشنده را با صدا جایگزین می‌کند

آمازون با معرفی قابلیت Join the chat، تجربه خرید را از جستجوی متنی به گفتگوهای صوتی زنده تبدیل کرده است. این ابزار با ترکیب مشخصات فنی و نظرات کاربران، نقش یک کارشناس فروش مجازی…

۲ دقیقه خواندن۱