پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۳۳۴ مقاله منتشر شده

عکس: رابط اپلیکیشن CartLens در حال اسکن رسید خرید با گوشی هوشمند
آموزش کاربردی

«شفافیت در قیمت‌ها»؛ هدف CartLens از اسکن هوشمند رسیدهای خرید

سرویس CartLens با استفاده از هوش مصنوعی چندوجهی، رسیدهای کاغذی را به داده‌های ساختاریافته تبدیل می‌کند تا شفافیت قیمت‌ها در فروشگاه‌های فیزیکی ایجاد شود. این ابزار به خریداران کمک…

۸ دقیقه خواندن
تصویری تبلیغاتی از Seedance 3 با پس‌زمینه‌ای آبی و نارنجی و متن «به زودی می‌آید»

نقشه راه Seedance 3: اولویت بایت‌دنس با قابلیت اطمینان در تولید ویدیو است

بایت‌دنس در نسل سوم مدل Seedance از نمایش‌های بصری خیره‌کننده به سمت ابزارهای تولیدی قابل‌اعتماد حرکت می‌کند. هدف این مدل حل چالش‌های فیزیک، ثبات شخصیت‌ها و ویرایش‌های موضعی در…

۱۲ دقیقه خواندن۱
علی‌بابا مدل هوش مصنوعی با ۵ تا ۱۰ تریلیون پارامتر توسعه می‌دهد

«هدف رسیدن به ASI»؛ استراتژی جدید علی‌بابا برای توسعه مدل‌ها

علی‌بابا با هدف رسیدن به ابرهوش مصنوعی (ASI)، در حال توسعه مدلی با ۵ تا ۱۰ تریلیون پارامتر است. این استراتژی شامل ادغام تراشه‌های اختصاصی، زیرساخت ابری ۲۰ گیگاواتی و مکانیزم…

۴ دقیقه خواندن
تصویر: رابط کاربری یک ژنراتور انیمه با تنظیمات پیش‌فرض و پارامترهای قابل تغییر
آموزش کاربردی

مدل Tsubaki.3 پرامپت‌ها را مانند توابع برنامه‌نویسی پردازش می‌کند

بررسی فنی مدل Tsubaki.3 نشان می‌دهد که جای خالی برخی جزئیات در پرامپت، باعث فعال شدن کلیشه‌های پیش‌فرض مدل می‌شود. کاربران با جایگزینی دستورات کلی با مقادیر دقیق و صریح، می‌توانند…

۴ دقیقه خواندن
استپ‌فان مدل Step 5 Preview را معرفی کرد: MoE با ۶۰۰ میلیارد پارامتر و پنجره زمانی یک میلیون توکن برای وظایف عاملی پیچیده

StepFun: کاهش هزینه‌های عملیاتی در مهندسی با مدل ۶۰۰ میلیارد پارامتری

شرکت StepFun مدل Step 5 Preview را با معماری ترکیب خبره‌ها و ۶۰۰ میلیارد پارامتر معرفی کرد. این مدل با تمرکز بر کاهش هزینه‌های عملیاتی در کارهای تخصصی مهندسی و مالی، پنجره متنی یک…

۴ دقیقه خواندن