پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۸۷۸ مقاله منتشر شده

غذای رایگان از سرآشپز خصوصی گرفتم که همه‌چیز را برای آموزش ربات‌ها فیلمبرداری کرد.

استراتژی Shift برای خرید تخصص انسانی در قالب داده‌های بصری

بخش Shift از استارتاپ Microagi با ارائه خدمات رایگان خانگی، داده‌های ویدئویی اول‌شخص متخصصان را برای آموزش ربات‌های انسان‌نما جمع‌آوری می‌کند. این اقدام برای پر کردن شکاف عظیم…

۵ دقیقه خواندن۲
ربات معامله‌گر هوشمند مبتنی بر مدل زبانی بزرگ (LLM) در حال تحلیل بازار و اجرای معاملات خودکار
آموزش کاربردی

موتور معاملاتی LLM_trader: جایگزینی داده‌های عددی با استنتاج تصویری

یک توسعه‌دهنده مستقل سیستمی متن‌باز ساخته است که به‌جای ارسال اعداد به مدل‌های زبانی، از تحلیل بصری نمودارهای 4K و اعتبارسنجی ریاضی استفاده می‌کند. این پروژه نشان می‌دهد که یک خط…

۷ دقیقه خواندن۱
کلینیک LLM2HUMAN | اقامتگاه رسمی ★
سرگرمی و خلاقیت

خدمات LLM2HUMAN؛ طنز عریان از تبدیل وزن‌های هوش مصنوعی به گوشت و پوست

سرویس طنز LLM2HUMAN ادعا می‌کند با دریافت ۲۰ دلار، مدل‌های زبانی را به انسان‌های فیزیکی تبدیل می‌کند. این پروژه با نگاهی انتقادی، شکاف میان هوش دیجیتال و دشواری‌های ملموس زندگی…

۴ دقیقه خواندن
تأخیر، مشکل واقعی تجربه کاربری در آواتارهای هوش مصنوعی است، نه صدا
آموزش کاربردی

تحلیل UX: تأخیر در استریمینگ مانع اثرگذاری کیفیت صدای آواتارهاست

کیفیت بالای صدا نمی‌تواند نقص آواتارهای هوش مصنوعی را بپوشاند اگر تأخیر سیستم باعث سکوت‌های طولانی شود. توسعه‌دهندگان باید به‌جای تمرکز بر انتخاب ارائه‌دهنده TTS، اولویت خود را بر…

۲ دقیقه خواندن۲
هوش مصنوعی و استدلال چندوجهی ریاضی: از حدس زدن تا تفکر واقعی
آموزش کاربردی

مدل‌های استدلالی با ترکیب منطق نمادین به صحت ۹۶ درصدی در بنچمارک MATH رسیدند

تغییری بنیادین در معماری هوش مصنوعی، «حدس زدن» را با استدلال آگاهانه جایگزین کرد. مدل‌های جدید سال ۲۰۲۶ با ترکیب شبکه‌های عصبی و منطق نمادین، مسائل ریاضی سطح مسابقات و علوم دکتری…

۸ دقیقه خواندن۱
مدل موسیقی لایریا ۳.۵ گوگل امکان ویرایش بخش‌های جداگانه آهنگ را بدون شروع مجدد فراهم کرد
سرگرمی و خلاقیت

Lyria 3.5 چگونه کیفیت صدا و زمان‌بندی آهنگ‌ها را بهبود می‌دهد؟

گوگل مدل تولید موسیقی خود را به نسخه Lyria 3.5 به‌روزرسانی کرد و قابلیتی برای ویرایش بخش‌های خاص آهنگ بدون نیاز به تولید مجدد کل اثر معرفی کرد. این مدل اکنون کنترل دقیق‌تری روی…

۱ دقیقه خواندن۲
افزودن پشتیبانی از Z.AI به Prism PHP: روش پیاده‌سازی یک ارائه‌دهنده LLM جدید
آموزش کاربردی

Prism PHP با معماری پیمانه‌ای پشتیبانی از مدل‌های Z.AI را اضافه کرد

پکیج Prism PHP با استفاده از یک ساختار ماژولار، مدل‌های GLM شرکت Z.AI را به اکوسیستم خود اضافه کرد. این یکپارچه‌سازی شامل قابلیت‌های تولید متن، فراخوانی ابزار و ورودی‌های چندوجهی…

۷ دقیقه خواندن