پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۱٬۴۲۰ مقاله منتشر شده

معماری پشت عامل فروش صوتی هوش مصنوعی که ساختم
آموزش کاربردی

درون معماری LangGraph؛ جداسازی منبع داده از استدلال برای فروش دقیق‌تر

یک توسعه‌دهنده معماری جدیدی برای عامل‌های صوتی فروش B2B طراحی کرده است که با تفکیک مدل زبانی از پایگاه‌داده، دقت داده‌های حساس مانند قیمت و موجودی را تضمین می‌کند. این سیستم با…

۹ دقیقه خواندن۳
ادغام مدل بینایی شیمیایی LG AI Research در پلتفرم Reaxys Elsevier

Elsevier با مدل MolMole تصاویر شیمیایی را به داده‌های قابل جست‌وجو تبدیل کرد

پلتفرم Reaxys با ادغام مدل بینایی MolMole متعلق به LG AI Research، ترسیم‌های شیمیایی در پتنت‌ها و مقالات را به داده‌های متنی تبدیل می‌کند. این فناوری نیاز به بررسی دستی ترکیبات…

۴ دقیقه خواندن۱
پژوهشگران سابق اپل، استارتاپ نوآنس لبز را تأسیس کردند که ۵۰ میلیون دلار سرمایه از انویدیا دریافت کرد.

«تعاملات انسانی طبیعی»؛ هدف Nuance Labs از مدل‌های بنیادین بصری-شنیداری

استارتاپ Nuance Labs برای جایگزینی زنجیره‌های تکه‌تکه‌ی آواتارهای هوش مصنوعی با یک مدل واحد و یکپارچه، ۵۰ میلیون دلار جذب کرد. این سیستم با پردازش هم‌زمان صدا و تصویر، تعاملات…

۴ دقیقه خواندن
ربات او ام-۱: آموزش سیاست ربات تنها با داده‌های انسانی، بدون تله‌اپراتور یا داده رباتیک

Reward AI: حذف وابستگی سخت‌افزاری در آموزش سیاست‌های کنترلی رباتیک

شرکت Reward AI با معرفی مدل OM-1، یادگیری مهارت‌های پیچیده رباتیک را از وابستگی به سخت‌افزار خاص جدا کرد. این سیستم به‌جای استفاده از داده‌های ربات، تنها از طریق یک دستکش…

۵ دقیقه خواندن
ناری لبز پیشتاز بنچمارک‌های هوش مصنوعی صوتی کووال

مدل‌های Nari Labs رکورد تأخیر و هزینه در هوش مصنوعی صوتی را شکستند

شرکت Nari Labs با بهینه‌سازی مدل‌های مبتنی بر Qwen3، جایگاه نخست بنچمارک‌های Coval را در زمینه سرعت و هزینه تبدیل متن به گفتار و بالعکس به دست آورد. این مدل‌ها در حالی عملکردی در…

۳ دقیقه خواندن
مد لباس خصمانه: اعتراضی به پانوپتیکون هوش مصنوعی
زندگی با AI

«بیانیه بصری حریم خصوصی»؛ راهکاری برای فریب سیستم‌های نظارت AI

صنعت نوظهور «مد لباس خصمانه» با استفاده از الگوهای هندسی و برش‌های خاص، سیستم‌های تشخیص چهره و نظارت را به اشتباه می‌اندازد. این پوشاک با تبدیل دفاع از حریم خصوصی به یک بیانیه…

۵ دقیقه خواندن۲
تست یک‌نسله برای تشخیص واقعی بودن تصویر خطی هوش مصنوعی
آموزش کاربردی

تست تک‌مرحله‌ای برای شناسایی خطاهای ساختاری در خطوط هوش مصنوعی

بسیاری از تصاویر خطی تولیدشده توسط هوش مصنوعی در ظاهر درست هستند اما به دلیل باز بودن محیط‌ها (Contours)، رنگ‌آمیزی حرفه‌ای آن‌ها غیرممکن است. یک روش اعتبارسنجی جدید با استفاده از…

۱۱ دقیقه خواندن