پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۸۳ مقاله منتشر شده

چرا سیستم‌های RAG توهم می‌زنند حتی وقتی بازیابی درست کار می‌کند
آموزش کاربردی

معماری سیستم در برابر نقص مدل؛ ریشهٔ خطاهای سامانه‌های RAG

بسیاری از شکست‌های سامانه‌های RAG ناشی از معماری سیستم است، نه نقص مدل‌های زبانی. با تبدیل بازیابی به مرحلهٔ «تولید کاندید» و افزودن لایه‌های بازرتبه‌بندی و اعتبارسنجی، می‌توان از…

۸ دقیقه خواندن۱
آی‌بی‌ام: مدل Granite Speech 5.0، ۳.۵ ساعت گفتار را در یک ثانیه رونویسی می‌کند

مدل Granite Speech 5.0 آی‌بی‌ام ۳.۵ ساعت صوت را در یک ثانیه تبدیل به متن می‌کند

آی‌بی‌ام دو مدل فشرده برای بازشناسی گفتار منتشر کرد که سرعت پردازش آن‌ها ۱۲ هزار برابر بیشتر از زمان واقعی است. این مدل‌ها با حذف کامل لایه زبانی، توان عملیاتی عظیمی را برای…

۴ دقیقه خواندن۱
تراشه‌های M6 و M5 Ultra اپل برای جهشی بزرگ در پردازش هوش مصنوعی

حافظه ۵۱۲ گیگابایتی M5 Ultra امکان اجرای مدل‌های ۱۰۰ میلیاردی را فراهم کرد

اپل با معرفی تراشه‌های M6 و M5 Ultra، سقف حافظه یکپارچه را به ۵۱۲ گیگابایت رساند. این جهش سخت‌افزاری به توسعه‌دهندگان اجازه می‌دهد مدل‌های زبانی بسیار بزرگ را به‌طور کامل و بدون…

۵ دقیقه خواندن۱
ساختار مدل‌های زبانی بزرگ Granite 4.2: معماری و روش آموزش
آموزش کاربردی

مدل‌های Granite 4.2 آی‌بی‌ام با یادگیری تقویتی مرحله‌بندی‌شده استدلال می‌کنند

آی‌بی‌ام خانواده مدل‌های استدلالی Granite 4.2 را با وزن‌های باز منتشر کرد که بر اساس ۱۵ تریلیون توکن آموزش دیده‌اند. این مدل‌ها با استفاده از یک خط لوله یادگیری تقویتی…

۲۵ دقیقه خواندن۳
شماره ۱۰۰ خبرنامه هوش مصنوعی فیزیکی فیوچرایکس — ۲۶ اوت

درون استراتژی Skild AI برای جایگزینی بدنه‌های مجزا با مدل‌های بنیادی

استارتاپ Skild AI با جذب ۱.۴ میلیارد دلار سرمایه، بر توسعه نرم‌افزاری تمرکز می‌کند که بتواند هر نوع سخت‌افزار رباتیک را کنترل کند. این تحول نشان‌دهنده گذار صنعت از ساخت بدنه های…

۱۹ دقیقه خواندن۳
بررسی مدل دوم دروازه جنجال: تحلیل و ارزیابی روش‌های تشخیصی در مدل‌های زبانی بزرگ
آموزش کاربردی

«تفکیک خلاقیت از بازبینی»؛ راهکاری برای مهار ریسک در شبکه‌های اجتماعی

یک چارچوب جدید برای عامل‌های هوش مصنوعی پیشنهاد می‌کند که وظیفه تولید محتوا و نظارت بر ریسک را بین دو مدل مجزا تقسیم کنند. این ساختار با جداسازی خلاقیت از بازبینی، احتمال انتشار…

۲ دقیقه خواندن۳
تراشه جالاپنیو OpenAI برای استنتاج سریع در مقیاس بزرگ ساخته شده است

آیا تراشه Jalapeño وابستگی OpenAI به پردازنده‌های انویدیا را کاهش می‌دهد؟

تراشه جدید OpenAI با نام Jalapeño، توان عملیاتی بالاتر در هر کیلووات و سرعت پاسخ‌دهی بیشتری نسبت به پردازنده‌های فعلی بازار دارد. این سخت‌افزار که با همکاری برادکام توسعه یافته،…

۲ دقیقه خواندن۱
همکاری هوش مصنوعی تسلیحاتی اوکراین و بریتانیا با اشتراک‌گذاری داده‌های میدانی برچسب‌دار

اوکراین ۵ میلیون تصویر جنگی را برای آموزش سلاح‌های خودکار بریتانیا باز کرد

اوکراین برای تسریع در توسعه سلاح‌های خودکار، دسترسی استارتاپ‌های بریتانیایی به «مجموعه داده‌های نظامی جامع» را فراهم کرد. این اقدام گسستی در روند آموزش مدل‌هاست و جایگزینی…

۵ دقیقه خواندن۳
عنوان مقاله: «چگونه از زیرعامل‌ها استفاده نکنیم!» — تصویر: دو ربات در حال بحث، یکی سرش را تکان می‌دهد و دیگری گیج به نظر می‌ر
آموزش کاربردی

۲ شرط لازم برای موفقیت در به‌روزرسانی انبوه کدها با هوش مصنوعی

تلاش یک توسعه‌دهنده برای به‌روزرسانی ۵۰۰ اسکریپت نشان داد که موازی‌سازی «کار» با موازی‌سازی «استدلال» متفاوت است. این پروژه تنها زمانی موفق شد که وظایف قطعی به اسکریپت‌ها سپرده شد…

۸ دقیقه خواندن