پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۸۷۶ مقاله منتشر شده

آموزش و استفاده از LoRA سفارشی بدون نیاز به GPU محلی
آموزش کاربردی

«تولید تصویر و ویدیو»؛ یکپارچه‌سازی زنجیره آموزش در پلتفرم LoRA AI

پلتفرم LoRA AI فرآیند آموزش مدل‌های انطباق کم‌رتبه را به‌طور کامل به مرورگر منتقل کرد. این ابزار نیاز به نصب CUDA یا داشتن GPUهای قدرتمند محلی را حذف کرده و زنجیره تولید تصویر و…

۱۱ دقیقه خواندن
شبیه‌ساز مصاحبه صوتی دوطرفه با هوش مصنوعی برای توسعه‌دهندگان
آموزش کاربردی

مکالمات صوتی در برابر متون استاتیک در شبیه‌ساز مصاحبهٔ DevPrep

ابزار جدید DevPrep با جایگزینی متون استاتیک با مکالمات صوتی دوطرفه، محیط واقعی مصاحبه‌های شغلی را شبیه‌سازی می‌کند. این پلتفرم بر کاهش فاصله میان دانش تئوری و توانایی بیان شفاهی…

۱ دقیقه خواندن
هوش مصنوعی می‌تواند اعتبار اعتبارات کربن را افزایش دهد؟ آزمایش من با جمینی 🌍
آموزش کاربردی

CarbonSense با مدل Gemini تصاویر ماهواره‌ای را به گزارش‌های شفاف کربن تبدیل کرد

پلتفرم جدید CarbonSense با ترکیب تصاویر ماهواره‌ای و هوش مصنوعی گوگل، نظارت بر اعتبارات کربنی را شفاف‌تر می‌کند. این ابزار داده‌های پیچیده محیطی را به تحلیل‌های متنی قابل‌فهم برای…

۲ دقیقه خواندن
آزمایشگاه ماشین‌های فکرگرای میرا مراتی: هوش مصنوعی انسان‌محور بر پایه وزن‌های مدل قابل‌سفارشی‌سازی

وزن‌های توزیع‌شده در برابر مدل‌های متمرکز برای ثبت دانش محلی

مجموعه Thinking Machines Lab به جای مدل‌های متمرکز و ایستا، سیستمی توزیع‌شده پیشنهاد می‌دهد که در آن کاربران وزن‌های مدل را شخصی‌سازی کنند. هدف این رویکرد، جذب دانش ضمنی و محلی…

۴ دقیقه خواندن
لوگوی Eclipsa Video در کنار نمادهای Dolby Vision و HDR10 با پس‌زمینه تاریک و نورهای درخشان

«یکسان‌سازی کیفیت تصویر»؛ هدف گوگل از معرفی استاندارد باز Eclipsa Video

گوگل استاندارد باز Eclipsa Video را برای یکسان‌سازی کیفیت نمایش HDR در نمایشگرهای مختلف معرفی کرد. این فناوری با همکاری اپل و NBCUniversal، از متادیتای پویا برای حذف مشکلاتی چون…

۲ دقیقه خواندن
مدل جهانی Orca چین بدون دیدن هیچ برچسب عملی، با سیستم‌های تخصصی رباتیک برابری می‌کند.

مدل Orca کنترل ربات‌ها را بدون نیاز به داده‌های برچسب‌گذاری‌شده ممکن کرد

پژوهشگران BAAI مدل Orca را معرفی کردند؛ سازوکاری که با یادگیری از ویدیوهای خام، بدون نیاز به دانستن دستورات حرکتی، کنترل ربات‌ها را به دقت سیستم‌های تخصصی می‌رساند. این مدل با…

۵ دقیقه خواندن
قلم شبح: قلمی ضد هوش مصنوعی که تنها انسان‌ها می‌توانند بخوانند
سرگرمی و خلاقیت

Ghost Font: متنی که انسان می‌خواند اما هوش مصنوعی نمی‌بیند

یک فونت آزمایشی جدید با استفاده از حرکت و نویز، متونی ایجاد می‌کند که برای انسان قابل خواندن اما برای مدل‌های چندوجهی هوش مصنوعی نامفهوم است. این سیستم با انتقال اطلاعات از تصاویر…

۵ دقیقه خواندن