پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۸۶۰ مقاله منتشر شده

بازیکن پوکر در حال بلوف زدن است؟ هوش مصنوعی این‌طور فکر می‌کند.
اخبار کوتاه روزانه

«ناتوان در تشخیص تل‌ها»؛ نقد بازیکنان به سیستم جدید ESPN

شبکه ESPN ابزاری مبتنی بر هوش مصنوعی را برای تحلیل حرکات بدنی بازیکنان و پیش‌بینی قدرت دست‌ها در مسابقات WSOP ۲۰۲۶ معرفی کرد. بازیکنان حرفه‌ای مدعی‌اند این سیستم به دلیل کمبود…

۷ دقیقه خواندن
تست MiniMax H3 با کارت گرافیک ۱۲ گیگابایتی: نتایج واقعی
آموزش کاربردیتأییدنشده · منبع منفرد

«سرعت پایین تولید»؛ چالش MiniMax H3 در سخت‌افزارهای میان‌رده

آزمون‌های جدید ثابت می‌کند مدل MiniMax H3 با کمک تکنیک CPU offloading روی کارت‌های گرافیکی ۱۲ گیگابایتی قابل اجراست. با Despite کیفیت بصری و صوتی بالا، سرعت تولید بسیار پایین است…

۲ دقیقه خواندن۲
افزایش مقیاس‌پذیری و عملکرد هوش مصنوعی اینفلوئنسر در ShadowSocial.io با Qwen-MAX و پروکسی معکوس Caddy
آموزش کاربردی

«اتوماسیون محتوای انبوه»؛ استراتژی جدید ShadowSocial برای مدیریت بار سرور

پلتفرم ShadowSocial.io با ادغام مدل چندوجهی Qwen-Max و پروکسی معکوس Caddy، تولید محتوای انبوه برای اینفلوئنسرهای مجازی را خودکار کرده است. این معماری با بهینه‌سازی توزیع رسانه و…

۲ دقیقه خواندن
انتخاب فریم، کل بازی است: نکات مهندسی از آموزش مدل‌های زبانی بزرگ برای تماشای ویدیو
آموزش کاربردی

claude-real-video هزینه توکن‌های ویدیو را با حذف فریم‌های تکراری کاهش داد

ابزار جدید و متن‌باز claude-real-video با جایگزینی نمونه‌برداری یکنواخت با یک سیستم حذف تکرار چندکاناله، بهره‌وری مدل‌های زبانی در تحلیل ویدیو را بالا برد. این ابزار با حفظ لحظات…

۶ دقیقه خواندن
بنیان‌گذاران DesignArena ۷.۹ میلیون دلار برای هوش مصنوعی باسلیقه جذب کردند | TechCrunch
اخبار کوتاه روزانه

«عبور از کاربردی به زیبا»؛ هدف جدید مدل‌های AI با داده‌های ترجیحی

استارتاپ Intelligence با جذب سرمایه برای پلتفرم DesignArena، داده‌های ترجیحی انسانی در زمینه زیبایی‌شناسی را برای آزمایشگاه‌های پیشرو AI فراهم می‌کند. این شرکت با کمک ۵.۳ میلیون…

۳ دقیقه خواندن۱
معماری راهکارهای مقیاس‌پذیر هوش مصنوعی اینفلوئنسر با ShadowSocial.io با بهره‌گیری از Likeness Lock v2.4 و صف‌بندی بدون RAM بی
آموزش کاربردی

ShadowSocial.io: بهینه‌سازی حافظه در زمان بیکاری، پایداری سیستم را تضمین می‌کند

پلتفرم ShadowSocial.io معماری جدیدی برای مدیریت اینفلوئنسرهای هوش مصنوعی معرفی کرد که از طریق بهینه‌سازی حافظه و قفل کردن چهره، پایداری سیستم را در زمان ترافیک بالا تضمین می‌کند.…

۲ دقیقه خواندن۱
جمینی رایگان در آمریکا: دسترسی به ساخت تصویر شخصی از گوگل فوتوز برای همه باز نشده — قبل از دسترسی به عکس‌ها این موارد را بررس
آموزش کاربردی

تولید تصویر با داده‌های شخصی؛ Gemini چگونه حریم خصوصی را بازتعریف می‌کند؟

گوگل به بخشی از کاربران ایالات متحده اجازه داد تا از عکس‌های شخصی خود در Google Photos به‌عنوان زمینه مستقیم برای تولید تصویر در Gemini استفاده کنند. این تغییر، تمرکز کاربر را از…

۳ دقیقه خواندن۲
پشتیبانی روز صفر MiniMax H3 در ComfyUI: وزن‌های باز، صدای بومی و ویدیوی ۲K
آموزش کاربردی

مدل MiniMax H3 مصرف حافظه گرافیکی را برای تولید ویدیوهای 2K تا ۶۶٪ کاهش داد

شرکت MiniMax مدل H3 را با وزن‌های باز منتشر کرد که تولید ویدیوهای 2K همراه با صدای استریو را ممکن می‌سازد. به‌ دلیل بهینه‌سازی‌های شدید در وزن‌ها، این مدل اکنون روی کارت‌های…

۲ دقیقه خواندن۱
برش ۹:۱۶ قبل از خرج کردن اعتبار: نکته‌ای برای تبدیل عکس به ویدیوی کوتاه با هوش مصنوعی
آموزش کاربردی

برش دستی تصاویر ۹:۱۶؛ راهکاری برای رفع تاری و اعوجاج در ویدیوهای هوش مصنوعی

یک گردش‌کار جدید برای مدل‌های تبدیل تصویر به ویدیو، از طریق برش دستی عکس‌ها به نسبت ۹:۱۶ پیش از آپلود، مانع از افت کیفیت می‌شود. با جداسازی ترکیب‌بندی از حرکت در پرامپت، کاربران…

۲ دقیقه خواندن۴