پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۸۷۸ مقاله منتشر شده

صدای تلفن دقیقاً شبیه رئیستان است. جعل آن ۵ دقیقه طول می‌کشد.
آموزش کاربردی

بحران آستانهٔ اقلیدسی: چرا احراز هویت بیومتریک تا سال ۲۰۲۶ منسوخ می‌شود

پیشرفت‌های سریع در مدل‌های انتشار صوتی و آواتارهای چهره، مفهوم «اثبات حضور» بیومتریک را از بین برده است. توسعه‌دهندگان باید از این پس با سیگنال‌های بیومتریک، نه به‌عنوان هویت،…

۳ دقیقه خواندن
کاربردهای برتر هوش مصنوعی مولد در توسعه کسب‌وکارها در ۲۰۲۶
آموزش کاربردی

۱۰ مورد کاربردی که استقرار تجاری هوش مصنوعی زاینده را در ۲۰۲۶ هدایت می‌کنند

سازمان‌ها از چت‌بات‌های ساده به سمت گردش‌کارهای عامل‌محور حرکت کرده‌اند که با داده‌های داخلی و نرم‌افزارهای موجود یکپارچه می‌شوند. تمرکز فعلی بر سیستم‌های عملیاتی با نتایج قابل…

۹ دقیقه خواندن۱
مدل پیشرفته FeyNoBg برای حذف پس‌زمینه تصاویر
آموزش کاربردی

درون معماری FeyNoBg؛ راهکار مدل‌های عمیق برای رزولوشن‌های فوق‌بالا

مدل متن‌باز FeyNoBg با گسترش معماری BiRefNet و تنوع‌بخشی به داده‌های آموزشی، استانداردهای حذف خودکار پس‌زمینه را جابه‌جا کرد. این مدل به‌ویژه در سناریوهای دشوار مانند تصاویر…

۷ دقیقه خواندن۱
کاربران Threads اکنون می‌توانند با هوش مصنوعی Meta در پیام‌های خصوصی گفتگو کنند.

تلفریق Meta AI با پیام‌های مستقیم تردز برای حذف هزینه‌ی جابه‌جایی اپلیکیشن

متا دستیار هوشمند خود را به پیام‌های خصوصی (DM) تردز آورد تا کاربران بدون خروج از محیط چت به ابزارهای AI دسترسی داشته باشند. هدف این حرکت، حبس کاربر در اکوسیستم متا و کاهش جذابیت…

۲ دقیقه خواندن۱
انگیما ۷۰ میلیون دلار جذب کرد تا کنترل ربات را ساده‌تر کند

قمار ۷۰ میلیون دلاری Enigma برای تبدیل کنترل ربات‌ها به یک پیچ تنظیم

استارتاپ Enigma با جذب ۷۰ میلیون دلار سرمایه، به جای تمرکز بر مغز ربات‌ها، روی رابط کاربری متمرکز شده است. این شرکت با اجرای یک آزمایش جهانی روی ۱۰۰ ربات، به‌دنبال کشف مکانیزمی…

۴ دقیقه خواندن۲
ربات جراحی در حال کار با محیط شبیه‌سازی شده تولیدی در زمان واقعی
آموزش کاربردی

انویدیا سرعت شبیه‌ساز جراحی Cosmos-H-Dreams را به ۱۶۰ فریم بر ثانیه رساند

انویدیا شبیه‌سازی Cosmos-H-Dreams را معرفی کرد که محیط‌های جراحی را با دقت فیزیکی و سرعت بالا بازسازی می‌کند. این سیستم با استفاده از تکنیک تقطیر مدل، امکان تمرین جراحی در زمان…

۶ دقیقه خواندن۱
ساخت میم هوش مصنوعی با متن خوانا از ابتدا
آموزش کاربردی

«جداسازی سلسله‌مراتب بصری»؛ راهکار جدید برای تولید متون خوانا در میم‌ها

یک چارچوب جدید برای تولید میم‌ها، پرامپت‌ها را به عنوان «مشخصات برنامه» تعریف می‌کند تا خطاهای نوشتاری مدل‌های تصویری حذف شوند. این روش با جداسازی سلسله‌مراتب بصری از توصیفات…

۳ دقیقه خواندن
موج‌های مغزی: کلید بعدی برای هوش مصنوعی فیزیکی؟

Zander Labs: حسگرهای عصبی دقت آموزشی ربات‌های انسان‌نما را بالا بردند

شرکت Encord با همکاری Zander Labs از حسگرهای امواج مغزی و سیگنال‌های عضلانی برای تولید داده‌های آموزشی با دقت بالا در هوش مصنوعی فیزیکی استفاده می‌کند. هدف این پروژه رفع کمبود…

۵ دقیقه خواندن