پرش به محتوای اصلی

موضوع

چندوجهی

Models that natively process text+image+audio+video

۸۶۰ مقاله منتشر شده

چت‌جی‌پی‌تی و تصویر: چرا محدودیت تولید عدد ندارد، اما رد درخواست منطقی؟
آموزش کاربردی

محدودیت‌های تولید تصویر ChatGPT بر اساس بار سرور و وصله‌های امنیتی تغییر می‌کند

نسخه ۲.۰ تصاویر ChatGPT حالت «تفکر» را برای مشترکان معرفی کرد، اما سقف تولید تصاویر همچنان پنهان و پویا است. کاربران با محدودیت‌های پیش‌بینی‌ناپذیر و اعوجاج چهره در تصاویر…

۷ دقیقه خواندن۲
لوگوی میسترال و نمودار عملکرد مدل Leanstral 1.5 در بنچمارک‌های ریاضی رسمی
اخبار کوتاه روزانه

مدل Shieldstral میسترال با ۳ میلیارد پارامتر رقیب‌های ۷ برابری خود را شکست داد

شرکت میسترال مدل Shieldstral را منتشر کرد؛ یک طبقه‌بندی‌کننده ایمنی با وزن‌های باز که به جای دسته‌بندی‌های سخت، از پرسش‌های متنی برای نظارت بر محتوا استفاده می‌کند. این مدل…

۴ دقیقه خواندن
لوگوی OpenAI و نماد مغز متصل به شبکه عصبی، نماد پروژه تلپاتی.

ناومی باشکانسکی از OpenAI جدا شد تا رابط‌های «سخن‌ناپذیر» مغز را بسازد

ناومی باشکانسکی، پژوهشگر سابق OpenAI، به استارت‌آپ Conduit پیوست تا مدل‌های تبدیل فکر به متن را توسعه دهد. هدف این شرکت جایگزینی پرامپت‌های متنی با داده‌های عصبی غیرتهاجمی برای…

۹ دقیقه خواندن۱
حلقه آموزش ممکن است مهم‌تر از مولد باشد: مدل‌سازی اکتشافی

آیا رویکرد XM می‌تواند مشکل تاری مود را در رباتیک حل کند؟

رویکرد جدید مدل‌سازی اکتشافی (XM) با انتقال پیچیدگی از مرحله استنتاج به چرخه آموزش، مشکل «تاری مود» را حل کرده است. این تکنیک امکان تولید خروجی‌های دقیق در یک گام را فراهم می‌کند…

۵ دقیقه خواندن۲
ابررایانه Alpamayo 2 انویدیا توسعه ربات‌تاکسی را برای استفاده تجاری ممکن ساخت
اخبار کوتاه روزانه

چگونه Alpamayo 2 Super کیفیت داده‌های آموزشی روبوتاکسی را ارتقا می‌دهد؟

انویدیا مدل استدلالی ۳۴ میلیارد پارامتری Alpamayo 2 Super را با مجوز تجاری منتشر کرد. این مدل به‌عنوان یک «معلم» برای تولید داده‌های آموزشی باکیفیت و زنجیره‌های استدلالی برای…

۵ دقیقه خواندن