
BrightShot زمان چیدمان مجازی املاک را از ۳۰ دقیقه به ۳ دقیقه رساند
عکاسان مستقل املاک با جداسازی پردازش HDR از مبلمان هوشمند، زمان ویرایش هر عکس را ۹۰٪ کاهش دادند. این گردش کار جدید اجازه میدهد بدون افت کیفیت، ظرفیت پذیرش پروژههای هفتگی بهطور…
موضوع
Models that natively process text+image+audio+video
۱٬۳۴۶ مقاله منتشر شده

عکاسان مستقل املاک با جداسازی پردازش HDR از مبلمان هوشمند، زمان ویرایش هر عکس را ۹۰٪ کاهش دادند. این گردش کار جدید اجازه میدهد بدون افت کیفیت، ظرفیت پذیرش پروژههای هفتگی بهطور…

شرکت Midjourney با معرفی یک اسکنر سونوگرافی پیشرفته قصد رقابت با MRI را دارد. با این حال، متخصصان پزشکی به دلیل نبود شواهد علمی و محدودیتهای فیزیکی سونوگرافی، نسبت به ادعاهای این…

تلاش یک توسعهدهنده برای ساخت ابزار تولید کارت بازی با Google AI Studio، نقاط ضعف جدی Gemini Flash را برملا کرد. این تجربه نشان میدهد تکیه بر حدسهای مدل بدون دانش معماری، منجر…

میسترال مدل OCR 4 را معرفی کرد؛ موتور استخراج متنی که در ارزیابیهای انسانی بر رقبای پیشرو غلبه کرده است. این مدل با تمرکز بر خروجیهای ساختارمند و قابلیت میزبانی شخصی، حریم خصوصی…

متا با کاهش ۱۰۰ دلاری قیمت و عرضه مدلهای مستقل، استراتژی سختافزاری خود را برای دسترسی گستردهتر تغییر داد. این مجموعه شامل مدلهای جدید و نسخهای ویژه با طراحی کایلی جنر است که…

استارتاپ سوئدی Fika Jobs برای تبدیل رزومههای متنی به پروفایلهای ویدئویی تعاملی، ۴ میلیون دلار سرمایه جذب کرد. این پلتفرم با استفاده از مدلهای Gemini، مصاحبههای اولیه را…

بایتدنس از طریق بازوی ابری خود، مدل Seedance 2.5 را معرفی کرد که قادر به تولید کلیپهای ۳۰ ثانیهای منسجم است. این بهروزرسانی در کنار مدل زبانی جدیدی عرضه شده که ۸۰٪ ارزانتر از…

شرکت بایدو مدل Unlimited-OCR را برای تحلیل اسناد چندصفحهای در یک مرحله (One-shot) معرفی کرد. این سیستم با حذف نیاز به تکهبندی متن، انسجام ساختاری اسناد پیچیده را در خروجیهای…

پلتفرم Oxlo.ai با جایگزینی مدل توکنمحور با قیمتگذاری ثابت بهازای هر درخواست، مانع مالی پردازش اسناد حجیم در لجستیک را حذف کرد. این سرویس با ادغام در OpenAI SDK، امکان استقرار…

متا و اسیلورلوکسوتیکا خط تولید Optics را برای ادغام هوش مصنوعی در عینکهای طبی عرضه کردند. با وجود بهبودهای ارگونومیک و پاسخدهی AI، قیمت بالا و نگرانیهای حریم خصوصی همچنان موانع…

پلتفرم Echonos با استفاده از یک خط لوله هوش مصنوعی، فایلهای صوتی را مستقیماً به ویدیوهای عمودی با کیفیت 2K تبدیل میکند. این ابزار با همگامسازی بصری بر اساس پروفایل انرژی…

مدل Vidu Q3 از شرکت Shengshu Technology اکنون روی پلتفرم MaaS هواوی کلاود در دسترس است. این ابزار با تمرکز بر تداوم بصری، تولید سریالهای کوتاه و تیزرهای تجاری را به سطح صنعتی…