پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۹ مقاله منتشر شده

نمودار معماری سیستم TREX: اجرای کد و تولید مصنوعات برای بازبینی هوشمند کد
آموزش کاربردی

تحلیل استاتیک در برابر اجرای پویا برای شناسایی باگ‌های رابط کاربری

شرکت Greptile لایه‌ی اجرایی TREX را معرفی کرد تا بررسی کدهای AI را از خواندن ساده به اجرای واقعی تغییر دهد. این رویکرد اجازه می‌دهد خطاهای منطقی و پس‌روی‌های رابط کاربری که در…

۷ دقیقه خواندن
ربات‌های خودآموز انویدیا با عامل‌های کدنویسی هوش مصنوعی آموزش می‌بینند

پژوهش انویدیا: کدنویسی خودکار هوش مصنوعی دقت رباتیک را به ۹۹٪ رساند

پژوهشگران انویدیا و دانشگاه‌های برکلی و کارنگی ملون سامانه‌ای به نام ENPIRE ساخته‌اند که در آن عامل‌های هوش مصنوعی به‌طور خودکار کدهای آموزشی ربات‌ها را می‌نویسند. این سیستم…

۴ دقیقه خواندن۱
۵ عادت برای پاسخ‌های بهتر از ChatGPT، بدون نیاز به مدل جدید
آموزش کاربردیتأییدنشده · منبع منفرد

تاثیر ۵ چارچوب دقیق دستوردهی بر کیفیت خروجی‌های مدل‌های زبانی

تجربه یک کاربر حرفه‌ای نشان می‌دهد که کیفیت دستورات ارسالی، تأثیر بسیار بیشتری نسبت به نسخه مدل دارد. تمرکز از انتخاب ابزار به چهارچوب‌های دقیق دستوردهی تغییر یافته است.

۵ دقیقه خواندن۱
ادایسه ۳۱۰ میلیون دلار سری B با ارزش‌گذاری ۱.۴۵ میلیارد دلار برای توسعه مدل‌های جهانی هوش مصنوعی جذب کرد.

درون قمار ۳۱۰ میلیون دلاری Odyssey برای آموزش فیزیک به هوش مصنوعی

آزمایشگاه Odyssey با جذب ۳۱۰ میلیون دلار سرمایه در valuation ۱.۴۵ میلیارد دلاری، قصد دارد مدل‌هایی بسازد که به جای پیش‌بینی کلمات، قوانین فیزیکی جهان را بشناسند. این پروژه با تکیه…

۴ دقیقه خواندن
اوپن‌ای‌آی بزرگ‌ترین مرکز داده خود را می‌خواهد و انویدیا هزینه آن را می‌پردازد

OpenAI دقت پیش‌بینی شکست‌های مدل‌های هوش مصنوعی را به ۹۲٪ رساند

پژوهشگران OpenAI روشی برای پیش‌بینی شکست‌های مدل‌های هوش مصنوعی توسعه داده‌اند که با جایگزینی تست‌های مصنوعی با مکالمات واقعی کاربران، دقت تشخیص خطاها را به شدت افزایش می‌دهد. این…

۴ دقیقه خواندن
لوگوی SubQ 1.1 Small: مدل زبانی کوچک و کارآمد با معماری بهینه‌سازی‌شده برای پردازش سریع‌تر و مصرف کمتر منابع.

«توجه پراکنده زیر-کوادراتی»؛ راهکار جدید برای افزایش سرعت استنتاج

مدل SubQ 1.1 Small با معرفی مکانیزم «توجه پراکنده زیر-کوادراتی»، پردازش تا ۱۲ میلیون توکن را با مقیاس‌پذیری خطی ممکن کرده است. این معماری هزینه‌های محاسباتی را به‌شدت کاهش داده و…

۵ دقیقه خواندن