پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۸۷۹ مقاله منتشر شده

نقش مدل‌های زبانی بزرگ در چت‌بات‌ها و دستیارهای مجازی
آموزش کاربردی

دستیارهای پویا در برابر چت‌بات‌های مبتنی بر کلمات کلیدی

مدل‌های زبانی بزرگ در حال جایگزینی چت‌بات‌های قدیمی مبتنی بر کلمات کلیدی هستند. این تغییر اجازه می‌دهد دستیاران هوشمند به جای دنبال کردن مسیرهای ثابت، خودشان جریان کاری را در لحظه…

۲ دقیقه خواندن۲
مدل جستجوی نوروسمبولیک Ontology 1 با دقت ۲.۷ برابر موتورهای جستجوی برتر تجارت الکترونیک جهان

مدل Ontology 1 دقت جست‌وجوی محصولات را در برابر گوگل و آمازون بالا برد

شرکت Onton مدل هوش مصنوعی Neurosymbolic را معرفی کرد که با استفاده از گراف دانش، در پاسخ به پرس‌وجوهای پیچیده تجاری، گوگل شاپینگ و آمازون را شکست می‌دهد. این مدل به‌جای تکیه بر…

۴ دقیقه خواندن
نمودار SVG قورباغه با فک برجسته هابسبورگ، بنچ‌مارک بهینه‌سازی گرافیک برداری.
سرگرمی و خلاقیت

«قورباغه‌های سلطنتی»؛ اثرات ناخواسته در خروجی‌های بصری هوش مصنوعی

یک محک جدید به نام FROGS_ نشان می‌دهد که مدل‌های هوش مصنوعی در مواجهه با پرامپت‌های ساده، دچار «بیش‌ویرایشگری» می‌شوند. این مدل‌ها به‌جای رسم یک قورباغه ساده، ویژگی‌های پزشکی و…

۷ دقیقه خواندن۲
دستگاه پاسخگوی هوشمند ساخت خودتان: راهنمای ساخت دستیار صوتی مبتنی بر هوش مصنوعی
آموزش کاربردی

ترکیب Twilio و Deepgram امکان ساخت دستیار تلفنی بدون سخت‌افزار را فراهم کرد

یک پیاده‌سازی فنی جدید به توسعه‌دهندگان اجازه می‌دهد با حذف زیرساخت‌های سخت‌افزاری پیچیده، دستیارهای تلفنی تمام‌خودکار بسازند. این سیستم با ایجاد یک پل صوتی دوطرفه، مدیریت پذیرش…

۴ دقیقه خواندن۴
آندره کارپاتی در حال سخنرانی در رویدادی مربوط به هوش مصنوعی و یادگیری ماشین

Opus 5 محیط‌های سه بعدی پیچیده را از یک پاراگراف متن خلق کرد

آندرج کارپاتی توانایی مدل Opus 5 در تبدیل متن به محیط‌های سه بعدی تعاملی و رویه‌ای را به نمایش گذاشت. این آزمایش نشان‌دهنده گذار به سوی جهان‌سازی «در لحظه» است، هرچند نبود بازخورد…

۲ دقیقه خواندن
مردی در حال بررسی صفحه قیمت‌گذاری APIهای تبدیل گفتار به متن با چهره‌ای در حال فکر کردن
آموزش کاربردی

آیا قابلیت‌های تشخیص نوبت گفتگو جایگزین دقت پایه در STT می‌شوند؟

بنچمارک ژوئیه ۲۰۲۶ نشان می‌دهد Melia-1 از Speechmatics در دقت و مدیریت تغییر زبان پیشتازی می‌کند. برای توسعه‌دهندگان، اولویت از دقت پایه به قابلیت‌هایی نظیر پرامپتینگ کلمات کلیدی…

۴ دقیقه خواندن
هنرمندان برای پذیرش هوش مصنوعی پول کافی می‌گیرند؟

پلتفرم Pippa برای هر بار استفاده از سبک هنرمندان به آن‌ها دستمزد می‌دهد

استارت‌آپ Pippa با معرفی مدلی برای پرداخت حق‌الامتیاز به هنرمندان، قصد دارد عصر استخراج غیرقانونی داده‌ها را به پایان برساند. در این پلتفرم، هر بار که کاربری ویدیویی با سبک یک…

۲ دقیقه خواندن
شماره ۷۷ خبرنامه FutureX · Physical AI Daily — ۰۳ اوت

مدل DreamDojo انویدیا با ۴۴ هزار ساعت ویدیو، حس مشترک فیزیکی را به ربات‌ها آموخت

انویدیا و شیائومی با استفاده از مجموعه‌داده‌های عظیم ویدیوهای انسانی، گلوگاه «برچسب‌گذاری عملیات» در هوش مصنوعی تجسم‌یافته را می‌شکنند. هم‌زمان، ظهور تک‌شاخ‌های انسانی در اروپا…

۱۹ دقیقه خواندن۲