پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۸۷ مقاله منتشر شده

Nous Research: کاهش ۲.۵ برابری زمان پیش‌آموزش LLM بدون تغییر در معماری

Nous Research: کاهش ۲.۵ برابری زمان پیش‌آموزش LLM بدون تغییر در معماری

پژوهشکده Nous Research روشی به نام آموزش برهم‌نهی توکن‌ها (TST) را معرفی کرده که سرعت پیش‌آموزش مدل‌های زبانی بزرگ را تا ۲.۵ برابر افزایش می‌دهد. این متد با پردازش دسته‌ای توکن‌ها…

۳ دقیقه خواندن۱
چگونه سیستم‌های چندعاملی شکاف تولید هوش مصنوعی در سازمان‌ها را پر می‌کنند؟
آموزش کاربردی

چگونه سیستم‌های چندعاملی شکاف تولید هوش مصنوعی در سازمان‌ها را پر می‌کنند؟

بسیاری از پروژه‌های هوش مصنوعی سازمانی به دلیل ناتوانی مدل‌های تک‌منظوره در مدیریت گردش‌کارهای پیچیده، در مرحله تولید شکست می‌خورند. سیستم‌های چندعاملی (MAS) با جایگزینی یک مدل…

۲ دقیقه خواندن۱
داده‌های LMSYS: افت پنهان عملکرد مدل‌های پرچم‌دار در سایه‌ی «نرفینگ»
آموزش کاربردی

داده‌های LMSYS: افت پنهان عملکرد مدل‌های پرچم‌دار در سایه‌ی «نرفینگ»

یک سامانه ردیابی جدید با تحلیل تاریخچه امتیازات LMSYS Arena، کاهش پنهان کیفیت مدل‌های برتر هوش مصنوعی را افشا کرد. این پدیده که «نرفینگ» نامیده می‌شود، اغلب نتیجه‌ی سخت‌گیرانه‌تر…

۲ دقیقه خواندن۱
کاهش ۴۰ درصدی هزینه‌های استنتاج با استانداردسازی درخواست‌ها روی OpenAI
آموزش کاربردی

کاهش ۴۰ درصدی هزینه‌های استنتاج با استانداردسازی درخواست‌ها روی OpenAI

یک توسعه‌دهنده با پیاده‌سازی لایه پروکسی برای استانداردسازی درخواست‌ها، هزینه‌های استنتاج مدل‌های زبانی را ۴۰٪ کاهش و ظرفیت پذیرش را ۵ برابر کرد. این متد با استفاده از نقاط…

۲ دقیقه خواندن
درون مدل «نرم‌افزار ۳.۰» کارپاتی: وقتی عامل‌ها ۸۰٪ کد را می‌نویسند

درون مدل «نرم‌افزار ۳.۰» کارپاتی: وقتی عامل‌ها ۸۰٪ کد را می‌نویسند

آندری کارپاتی چارچوب «نرم‌افزار ۳.۰» را معرفی کرد و استدلال می‌کند که زبان طبیعی و کانتکست جایگزین کدهای صریح شده‌اند. در این مدل، نقش برنامه‌نویس از نویسنده‌ی منطق به ارکستراتور…

۳ دقیقه خواندن
چرا عامل‌های دیتابیس شما اعداد درآمد را حدس می‌زنند و نه محاسبه می‌کنند؟
آموزش کاربردی

چرا عامل‌های دیتابیس شما اعداد درآمد را حدس می‌زنند و نه محاسبه می‌کنند؟

عامل‌های هوش مصنوعی اغلب کدهای SQL صحیحی می‌نویسند که از نظر منطق تجاری غلط هستند. برای حل این مشکل، توسعه‌دهندگان باید به‌جای تکیه بر پرامپت‌های شکننده، از «نماهای تأییدشده»…

۲ دقیقه خواندن۱
چرا بازیابی لغت‌محور هنوز در پژوهش‌های عمیق از جستجوی متراکم پیش می‌گیرد؟

چرا بازیابی لغت‌محور هنوز در پژوهش‌های عمیق از جستجوی متراکم پیش می‌گیرد؟

پژوهش جدید Pi-Serini نشان می‌دهد که ترکیب بازیابی لغت‌محور (BM25) با مدل‌های پیشرو مانند GPT-5.5 در وظایف پژوهشی عمیق، عملکرد بهتری نسبت به سیستم‌های جستجوی متراکم دارد. این سیستم…

۲ دقیقه خواندن۱