پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۴۲۵ مقاله منتشر شده

ویرایشگر ویدیوی مرورگری بدون وابستگی با کنترل هوش مصنوعی — تایم‌لاین JSON، رابط MCP و REST، UI با بارگذاری زنده
آموزش کاربردی

FableCut: تبدیل فایل JSON به فرمان‌روای تدوین ویدیو برای عامل‌های هوش مصنوعی

افزار FableCut با تبدیل کل خط زمانی تدوین را به یک سند JSON، امکان کنترل دقیق و لحظه‌ای ویدیوها را به عامل‌های هوشمند می‌دهد. این سیستم برخلاف مدل‌های مولد، اجازه می‌دهد انسان و…

۵ دقیقه خواندن۱
شخصیت‌ساز هوش مصنوعی Character.ai به عرصه میکرودراما وارد شد، اما با یک تغییر جالب.

درون استراتژی جدید Character.ai برای گذار از مدل استودیویی به کاربرمحوری

پلتفرم Character.ai با ورود به بازار میکرودراما، سریال‌هایی تولید کرده که کاربران می‌توانند با شخصیت‌های آن گفتگو کنند و مسیر داستان را تغییر دهند. این شرکت قصد دارد از یک مدل…

۲ دقیقه خواندن۱
سه معماری رندرینگ با یک برچسب مشترک: «تولیدکننده آواتار هوش مصنوعی»
آموزش کاربردی

معماری رندرینگ؛ عامل تعیین‌کننده در هزینه و سرعت آواتارهای هوش مصنوعی

ابزارهای ساخت آواتار بر اساس سه معماری رندرینگ متفاوت عمل می‌کنند که مستقیماً بر سرعت، پایداری و مدل قیمت‌گذاری آن‌ها اثر می‌گذارد. انتخاب اشتباه ابزار بدون درک این تفاوت‌ها، منجر…

۵ دقیقه خواندن۱
شرط ۲.۳ میلیارد دلاری جنرال اینتویشن: بازی‌های ویدیویی می‌توانند عامل‌های هوش مصنوعی را برای دنیای واقعی آموزش دهند.

آموزش ربات‌ها با داده‌های بازی‌های ویدئویی؛ کاهش زمان یادگیری به ۸ دقیقه

استارتاپ General Intuition با استفاده از میلیون‌ها ساعت داده‌های بازی‌های ویدئویی، مدلی بنیادی برای هوش مصنوعی فیزیکی ساخته است. این روش اجازه می‌دهد ربات‌ها حرکات پیچیده را با…

۳ دقیقه خواندن۱
ویژگی جدید «ریمیکس ویدیو» گوگل برای مشترکان هوش مصنوعی رونمایی شد

گوگل با قابلیت Video Remix خاطرات تصویری را به استودیو تولید تبدیل کرد

گوگل ابزار Video Remix را برای مشترکان سرویس‌های هوش مصنوعی خود عرضه کرد. این قابلیت با بهره‌گیری از مدل Gemini Omni، امکان تغییر سبک، نورپردازی و پس‌زمینه ویدیوهای ذخیره شده را…

۲ دقیقه خواندن
مدیرعامل: داده‌های بازی ویدیویی برای آموزش هوش مصنوعی از اینترنت بهترند

داده‌های بازی‌های ویدئویی در برابر وب برای آموزش درک مکانی هوش مصنوعی

استارت‌آپ General Intuition با استفاده از داده‌های بازی‌های ویدئویی، در حال آموزش هوش مصنوعی برای درک حرکت اشیاء در مکان و زمان است. این شرکت با جذب ۳۲۰ میلیون دلار سرمایه، قصد…

۲ دقیقه خواندن۱
تصویر: نمونه‌ای از خروجی مقاله که در آن نشانگرهای تفکر یا توکن‌های ویژه در متن نهایی ظاهر شده‌اند.
آموزش کاربردی

مقایسه‌ی مدل‌های چینی؛ DeepSeek و Qwen هزینه‌ی استنتاج را به کف رساندند

بررسی چهار خانواده مدل برتر چینی نشان می‌دهد که این مدل‌ها اکنون با قیمت‌هایی بسیار پایین‌تر و عملکردی رقابتی در برابر غول‌های غربی قرار دارند. تحلیل‌ها DeepSeek را برای کدنویسی…

۸ دقیقه خواندن۱