
نظارت غیرفعال در برابر تحلیل لحظهای؛ تغییر کاربری CCTV در خردهفروشی
خردهفروشان با استفاده از تحلیل ویدئویی مبتنی بر هوش مصنوعی، دوربینهای امنیتی را به ابزارهای استخراج داده تبدیل میکنند. این تغییر، نظارت غیرفعال را به بینشهای لحظهای درباره…
موضوع
Models that natively process text+image+audio+video
۱٬۴۲۰ مقاله منتشر شده

خردهفروشان با استفاده از تحلیل ویدئویی مبتنی بر هوش مصنوعی، دوربینهای امنیتی را به ابزارهای استخراج داده تبدیل میکنند. این تغییر، نظارت غیرفعال را به بینشهای لحظهای درباره…

شرکت LandingAI با معرفی نسل دوم سیستم استخراج مستندات (ADE Gen2)، ساختار متنی ساده را با مدل درختی جایگزین کرد تا دقت مبنیسازی را افزایش دهد. این بهروزرسانی با تغییر مدل…

اپل در تراشههای جدید خود از یک بخش ایزوله سختافزاری برای پردازش صدا استفاده کرده است تا حتی سیستمعامل هم به فایلهای خام دسترسی نداشته باشد. این معماری اجازه میدهد ویژگیهای…

گوگل و ناسا با معرفی مدل یادگیری عمیق MAPL-EMIT، شناسایی نشتهای متان را ۵۰٪ دقیقتر از تحلیلگران انسانی کردند. این سامانه با تحلیل دادههای ماهوارهای، نشتهای متان را در ۲۴ مورد…

اپلیکیشنهای ترجمه در حال تبدیل شدن به گرافهای استنتاج پیچیدهای هستند که بینایی ماشین، بازشناسی گفتار و رباتیک را ادغام میکنند. توسعهدهندگان اکنون باید برای پاسخهای…

گوگل با ادغام ابزارهای صوتی تعاملی در Workspace و معرفی قابلیت ساخت اپلیکیشن با زبان طبیعی در Sheets، لایهی هوش مصنوعی خود را از یک دستیار جانبی به هستهی عملیاتی تبدیل میکند.…

شرکت Cloudphysician مدل بنیادی Nightingale را برای نظارت شبانهروزی بیماران معرفی کرد. این سامانه با پردازش دادهها در محیط بیمارستان، هزینههای پهنای باند و استنتاج را در مقایسه…

انتخاب یک ابزار تولید تصویر انیمه نیازمند چیزی فراتر از تماشای گالریهای تبلیغاتی است. این راهنما ۵ تست عملی — از ثبات شخصیت تا ویرایش دقیق — را معرفی میکند تا مشخص شود آیا یک…

شرکت ریویان با طراحی تراشه اختصاصی و عقد قرارداد ۱.۲۵ میلیارد دلاری با اوبر، قصد دارد از سطح ۲ به سطح ۴ اتونومی جهش کند. این استراتژی بر پایه مدلهای رانندگی بزرگ و ادغام…

شرکت Suno برای کاهش دعاوی حقوقی، مدلهای نسل ششم خود را با دادههای قانونی از برچسبهای موسیقی بزرگ آموزش داد. این بهروزرسانی شامل ابزارهای ویرایش دقیق و سیستمی طبقهبندیشده…

شرکت دیپسیک مدل V4.1 Flash را جایگزین V4 Pro کرد. این مدل جدید در تمامی معیارهای کلیدی از جمله سرعت و هزینه، عملکرد بهتری دارد و هزینههای عملیاتی را برای کاربران بهشدت کاهش…

آمازون با ترکیب هوش مصنوعی و جلوههای ویژه، حرکت لب بازیگران را با صدای دوبله تطبیق میدهد. این قابلیت ابتدا در سریال Maxton Hall اجرا شده و قرار است به سایر آثار گسترش یابد.