پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۳ مقاله منتشر شده

لوگوی شرکت مشی روی پس‌زمینه‌ای تیره با نماد سه‌بعدی آبی و بنفش

«تبدیل متن به مدل سه‌بعدی»؛ موتور محرک درآمد ۱۰۰ میلیون دلاری Meshy

استارتاپ Meshy با تبدیل متن و تصویر به مدل‌های سه‌بعدی، درآمد سالانه خود را به ۱۰۰ میلیون دلار رساند. این شرکت اکنون از ابزارهای حرفه‌ای به سمت بازی‌های مصرف‌کننده و خلق محتوای…

۴ دقیقه خواندن۳
عواملی که یاد می‌گیرند: ویکی حافظه

ویکیِ حافظه در JackHamr جلوی تکرار اشتباهات عامل‌های هوش مصنوعی را گرفت

پلتفرم JackHamr با معرفی یک «ویکی حافظه» خودبه‌روزشونده، امکان ذخیره دائمی قواعد کدنویسی و ساختار پروژه‌ها را برای عامل‌های هوش مصنوعی فراهم کرد. این سازوکار مانع از آن می‌شود که…

۳ دقیقه خواندن
تنظیمات حذف آپلود در ChatGPT و نارضایتی کاربران در تابستان ۱۴۰۳
زندگی با AI

کتابخانه ChatGPT: استراتژی OpenAI برای تبدیل داده‌های کاربر به ابزار حفظ مشتری

اوپن‌ای‌آی با معرفی قابلیت Library، مدل ذخیره‌سازی داده‌ها را به سمتی برده است که حذف انبوه اطلاعات برای کاربر دشوار شده است. این تغییر اگرچه حافظه مدل را تقویت می‌کند، اما…

۹ دقیقه خواندن۱
مدل زبانی در حال نوشتن گزارشی با چهره‌ای در حال پنهان کردن اخبار منفی است.

«فقط در صورت درخواست صداقت»؛ شرط افشای نقص‌های فنی توسط LLMها

پژوهشی مشترک از MIT، گوگل و هاروارد نشان می‌دهد مدل‌های زبانی پیشرو برای حفظ «روایت موفقیت»، نقص‌های فنی و داده‌های منفی را در گزارش‌ها حذف می‌کنند. این مدل‌ها تنها در صورتی صادق…

۹ دقیقه خواندن۱
مدل‌های باز‌منبع بهتر می‌شوند؛ اقتصادشان پیچیده‌تر.

شکاف ۱۸ امتیازی بین مدل‌های باز و بسته در وظایف پیچیدهٔ عامل‌محور

تحلیل ۴۶ مدل نشان می‌دهد نمرات بنچمارک‌ها ویژگیِ مدل نیستند، بلکه بازتابی از سیستم نرم‌افزاری پیرامون آن‌ها هستند. در حالی که مدل‌های وزن‌باز در تکالیف کوتاه به رقبای تجاری…

۵ دقیقه خواندن۲
لایه توسعه فورج کورویو برای ساخت مدل‌ها و عامل‌های هوش مصنوعی

CoreWeave Forge: یکپارچه‌سازی چرخه توسعه مدل‌های هوش مصنوعی در یک لایه

شرکت CoreWeave پلتفرم Forge را برای حذف گسست میان مراحل آموزش، ارزیابی و نظارت بر مدل‌ها معرفی کرد. این ابزار با ادغام زیرساخت‌های ابری و ابزارهای تخصصی، «اتلاف سیگنال» در چرخه…

۴ دقیقه خواندن۲
توسعه آزمون‌محور با عامل‌های کدنویسی: قوانین را بنویسید، سپس بررسی کنید رعایت شده‌اند
آموزش کاربردی

تست‌های توخالی؛ چرا عامل‌های کدنویس با وجود چراغ سبز شکست می‌خورند؟

عامل‌های کدنویس اغلب تست‌هایی تولید می‌کنند که حتی با وجود نقص در کد، پاس می‌شوند. یک چارچوب جدید با ترکیب قوانین سخت‌گیرانه و «تست جهش»، اعتبار واقعی تست‌های تولیدشده توسط هوش…

۱۴ دقیقه خواندن۱
ربات‌های معاملاتی Jev: بررسی نتایج واقعی ۱۹ پروژه
آموزش کاربردی

۱۹ پروژه معاملاتی Jev در برابر استراتژی‌های ساده شکست خوردند

یک حسابرسی جامع نشان می‌دهد هیچ‌یک از ربات‌های معاملاتی مبتنی بر مدل Jev نتوانستند از قوانین ساده‌ی خرید و فروش پیشی بگیرند. در حالی که این مدل در طبقه‌بندی داده‌های ساختاریافته…

۴ دقیقه خواندن۱