پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۴۲۵ مقاله منتشر شده

مرکز داده هوش مصنوعی انویدیا با دمای بالاتر، مصرف انرژی کمتر

طراحی جدید روبین انویدیا مصرف آب مراکز داده را کاهش می‌دهد

انویدیا با معرفی معماری روبین، استراتژی خنک‌سازی مراکز داده را تغییر داد تا با افزایش دمای عملیاتی، مصرف آب را به‌شدت کاهش دهد. این اقدام پاسخ مستقیم شرکت به فشارهای محیط‌زیستی و…

۵ دقیقه خواندن۱
سازنده ویدیوی هوش مصنوعی چینی کلینگ ۲ میلیارد دلار جذب سرمایه کرد

Kling: جذب ۲ میلیارد دلار پیش از ورود به بازار سرمایه هنگ‌کنگ

بخش هوش مصنوعی ویدئویی شرکت کوایشو (Kuaishou) با جذب سرمایه‌ای کلان، اکنون آماده عرضه اولیه در بورس هنگ‌کنگ است. این حرکت نشان می‌دهد چین از مرحله توسعه مدل‌ها به سمت تجاری‌سازی…

۱ دقیقه خواندن
چرا اشتراک ۵ ابزار هوش مصنوعی را لغو کردم و از یک ابزار استفاده می‌کنم
زندگی با AI

جایگزینی اشتراکات ماهانه با مدل اعتباری؛ کاهش هزینه‌های AI از ۱۲۰ دلار به

یک تولیدکننده محتوا با تجمیع پنج اشتراک مختلف در یک فضای کاری اعتباری، هزینه‌های ماهانه خود را از ۱۲۰ دلار به مدل پرداخت به‌ازای مصرف تغییر داد. این تغییر علاوه بر حذف هزینه‌های…

۲ دقیقه خواندن۲
گیت‌هاب - ابزار محلی برای تحلیل ویدیو با کلود: استخراج فریم‌های کلیدی و رونوشت، از URL یا فایل محلی، مجوز MIT.
آموزش کاربردی

حذف فریم‌های تکراری؛ راهکار claude-real-video برای تماشای ویدیو توسط مدل‌های

ابزار متن‌باز جدیدی عرضه شده است که به مدل‌های زبانی اجازه می‌دهد به‌جای نمونه‌برداری خشک از فریم‌ها، تنها تغییرات معنا‌دار صحنه را «ببینند». این سیستم با اجرای محلی و حذف…

۴ دقیقه خواندن
اپلیکیشن بازی‌سازی «پاکت» با قابلیت کدنویسی هوشمند، بدون خبررسانی رسمی راه‌اندازی شد | تک‌کرانچ

Gizmo: زیرساختی برای تبدیل پرامپت به بازی‌های تعاملی در اپلیکیشن Pocket

متا اپلیکیشن Pocket را برای ساخت بازی‌های تعاملی و برنامه‌های کوچک با استفاده از هوش مصنوعی زاینده عرضه کرد. این ابزار که بر پایه فناوری Gizmo ساخته شده، فاصله بین ایده و اجرای یک…

۲ دقیقه خواندن
از پرامپت تا پلی‌لیست: تبدیل آهنگ‌های هوشمند به اکوسیستم صوتی شخصی برای سازندگان مستقل
آموزش کاربردی

درون مسیر گذار تولیدکنندگان موسیقی از تک‌قطعه به اکوسیستم‌های هوش مصنوعی

سازندگان مستقل از تولید پراکنده موسیقی به سمت ایجاد «اکوسیستم‌های صوتی» حرکت می‌کنند. با تبدیل پرامپت‌ها به APIهای پایدار، آن‌ها اکنون برند صوتی یکسانی را در تمام کانال‌های…

۵ دقیقه خواندن۱
سیستم‌عامل سه‌لایه در حال اجرای یک باشگاه واقعی: نسخه ریسه‌ای
آموزش کاربردی

۳ لایهٔ عملیاتی برای نقشه‌برداری از رفتارهای ورزشی در محیط واقعی

شبکه ورزشی Wanjian با استقرار یک معماری سه لایه، داده‌های رفتاری کاربران را در محیط واقعی استخراج کرد. این سیستم با ترکیب رایانش لبه و بینایی ماشین، شکاف داده‌ای میان گجت‌های…

۲ دقیقه خواندن۲
تبدیل PDFهای پژوهشی به JSON ساخت‌یافته با ارزیابی کنترل‌شده در سطح فیلد
آموزش کاربردی

مدل Lift با راهنمای طرح‌واره، PDFهای پژوهشی را به داده‌های ساختاریافته تبدیل

مدل Lift با استفاده از استخراج داده‌ها بر اساس طرح‌واره (Schema) و کوانتش ۴-بیتی، اسناد PDF را به فرمت JSON تبدیل می‌کند. این روش امکان استخراج دقیق داده‌های فنی را حتی روی…

۱۴ دقیقه خواندن
تماس نیمه‌شب که قبل از پایان حرف کاربر قطع شد، و هفته‌ای که صرف فهمیدن چرا ردیاب آن را ندید کردم.
آموزش کاربردی

شکاف لایه‌ی صوتی؛ دلیل اصلی شکست عامل‌های صوتی در مقیاس واقعی

ابزارهای نظارتی فعلی با نادیده گرفتن خط لوله‌ی صوتی، ریشه‌ی شکست عامل‌های صوتی را پنهان می‌کنند. تحلیل‌های عملی نشان می‌دهد خطاهای بحرانی مانند قطع تماس، محصول زمان‌بندی…

۶ دقیقه خواندن۲