پرش به محتوای اصلی

موضوع

داده‌های مصنوعی

داده‌های تولیدشده به صورت مصنوعی با استفاده از الگوریتم‌های هوش مصنوعی برای آموزش مدل‌ها و حفظ حریم خصوصی

۱۴۲ مقاله منتشر شده

دیوار داده هوش مصنوعی واقعی است. آنچه درباره رفع آن با داده مصنوعی نمی‌گویند.
آموزش کاربردی

گارتنر: ۷۵٪ داده‌های توسعه هوش مصنوعی تا سال ۲۰۲۶ مصنوعی خواهند بود

پژوهشگران هوش مصنوعی به‌دلیل اتمام متون باکیفیت انسانی با «دیوار داده» مواجه شده‌اند. برای عبور از این بن‌بست، تیم‌های مهندسی به داده‌های مصنوعی روی آورده‌اند، اما نبودِ بذر‌های…

۴ دقیقه خواندن۱
نمایی از مجموعه داده ویدیویی بزرگ LAION: نمونه‌هایی از محتوای متنوع ویدیویی در مقیاس گسترده

مجموعه داده LAION-BVD: ۱۰ میلیون ساعت ویدیو برای پیش‌آموزش مدل‌های چندوجهی

پروژه LAION یک مجموعه داده باز به نام LAION-BVD شامل ۸۰ میلیون ویدیو و ۱.۳ میلیارد URL منتشر کرد. این اقدام با هدف شکستن انحصار غول‌های فناوری بر داده‌های آموزشی مقیاس‌بزرگ برای…

۳ دقیقه خواندن۱
پالایش داده برای پیش‌آموزش ویدیویی مولد | یادداشت‌های میدانی لینوم
آموزش کاربردی

Linum زمان آموزش حرکات پیچیده ویدیو را از هفته‌ها به ۲۴ ساعت رساند

استارتاپ Linum با جایگزینی فیلترهای ارزان‌قیمت CPU با سیستم‌های شتاب‌یافته GPU و یادگیری تقویتی (RLVR)، نویز داده‌های پیش‌آموزش را حذف کرد. این چرخش راهبردی باعث شد مدل‌های تولید…

۲۰ دقیقه خواندن۱
آی‌بی‌ام: مدل Granite Speech 5.0، ۳.۵ ساعت گفتار را در یک ثانیه رونویسی می‌کند

مدل Granite Speech 5.0 آی‌بی‌ام ۳.۵ ساعت صوت را در یک ثانیه تبدیل به متن می‌کند

آی‌بی‌ام دو مدل فشرده برای بازشناسی گفتار منتشر کرد که سرعت پردازش آن‌ها ۱۲ هزار برابر بیشتر از زمان واقعی است. این مدل‌ها با حذف کامل لایه زبانی، توان عملیاتی عظیمی را برای…

۴ دقیقه خواندن
قانون‌های مقیاس‌پذیری تقطیر: انتقال دانش فیزیک به آموزش

اپل قوانین مقیاس‌پذیری تقطیر مدل‌ها را به یک مسئله ریاضی تبدیل کرد

پژوهشگران اپل نخستین قوانین مقیاس‌پذیری پیش‌بینی‌پذیر برای تقطیر دانش را تدوین کردند. این دستاورد، آموزش مدل‌های کوچک را از یک فرآیند آزمون و خطا به یک مسئله بهینه‌سازی ریاضی دقیق…

۲ دقیقه خواندن
برایان روملی در ایکس
زندگی با AI

مهاجرت تفکر انسانی به چت‌بات‌ها؛ تخلیهٔ تدریجی ذخایر دانش وب

انتقال پرسش‌های پیچیده از تالارهای گفتگو به محیط‌های خصوصی هوش مصنوعی، باعث ایجاد «وارونگی دانش» شده است. این روند استدلال‌های سطح بالا را در سیلوهای شرکتی حبس کرده و وب را با…

۳ دقیقه خواندن۱
سیاست داده برای پشتیبانی مشتری با هوش مصنوعی
آموزش کاربردی

«پاک‌سازی PII»؛ راهکار جدید برای جلوگیری از نشت داده در چت‌های B2B

یک چارچوب معماری جدید برای خدمات مشتریان، با استفاده از «درگاه‌های بازبینی» و داده‌های مصنوعی، از نشت اطلاعات شناسایی شخصی (PII) جلوگیری می‌کند. این روش اجازه می‌دهد شرکت‌ها بدون…

۲ دقیقه خواندن
عنوان تصویر: یک خانواده در حال استفاده از ChatGPT در خانه، نمادی از ورود هوش مصنوعی به زندگی روزمره

مطالعهٔ Pew Research: ۳۵٪ از صفحات وب جدید توسط هوش مصنوعی نوشته شده‌اند

گزارشی جدید نشان می‌دهد بیش از یک‌سوم صفحات وب منتشرشده پس از عرضه ChatGPT، توسط هوش مصنوعی تولید یا ویرایش شده‌اند. این روند در دامنه‌های .com بسیار شدیدتر است و نشان از تبدیل…

۳ دقیقه خواندن۲
پیشگام هوش مصنوعی ساتون: داده‌های مصنوعی در جهانی بی‌نهایت پیچیده، «اشتباه بزرگی» است

ریچارد ساتون: تکیه بر داده‌های مصنوعی اشتباهی بزرگ در مسیر مقیاس‌پذیری AI

ریچارد ساتون، پیشگام یادگیری تقویتی، استدلال می‌کند که داده‌های مصنوعی نمی‌توانند گلوگاه مقیاس‌پذیری مدل‌های زبانی را حل کنند زیرا جهان واقعی بی‌نهایت پیچیده‌تر از هر شبیه‌سازی…

۳ دقیقه خواندن