
Exa: افزایش ۱۵۷۹ درصدی شناسایی موجودیتها در حالت Agent Ultra
شرکت Exa حالت Agent Ultra را معرفی کرد؛ یک API با محاسبات بالا که از تیمی از زیر-عاملها برای پژوهشهای جامع استفاده میکند. این سیستم در بنچمارکهای جمعآوری داده، مدلهای برتر…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۶۶۹ مقاله منتشر شده

شرکت Exa حالت Agent Ultra را معرفی کرد؛ یک API با محاسبات بالا که از تیمی از زیر-عاملها برای پژوهشهای جامع استفاده میکند. این سیستم در بنچمارکهای جمعآوری داده، مدلهای برتر…

مدل جدید OpenAI در شناسایی اشتباهات فیزیکی هنگام سرهم کردن وسایل خانه جهشی بزرگ داشته است. این دستاورد نشاندهنده پیشرفت جدی در استدلال بصری برای وظایف پیچیده دنیای واقعی است.

AugLy چارچوبی جامع برای ایجاد اختلالات عمدی در دادههای تصویری، متنی و صوتی است تا نقاط ضعف مدلهای هوش مصنوعی شناسایی شود. این ابزار با شبیهسازی نویزهای دنیای واقعی، به…

یک پیادهسازی جدید با استفاده از احتمالات توکن (logprobs)، مدلهای بینایی را به طبقهبندیکنندههای سریع تبدیل میکند. این روش با محدود کردن خروجی به یک توکن، امکان استخراج…

یک متد جدید با ترکیب لنگرهای دادهای و بهروزرسانیهای ادغامشدهٔ LoRA، مانع از فراموشی فاجعهبار در مدلهای زبانی بزرگ میشود. این رویکرد نرخ حفظ دانش در ۱۰۰ تکلیف مختلف را از…

هوش مصنوعی سازمانی از دستیارهای تکمنظوره به سمت «بافتهای چندعاملی» حرکت میکند که لایههای کنترل و اجرا را از هم جدا میکنند. این ساختار با ایجاد یک لایه هماهنگی مشترک، از تکرار…

یک گزارش مهندسی نشان میدهد چرا انتخاب ابزار توسط مدل زبانی به معنای داشتن مجوز برای اجرای آن نیست. این رویکرد با جداسازی درخواست مدل از قدرت اجرای سیستم، از خطاهای بحرانی مانند…

آمازون برای محافظت از درآمدهای تبلیغاتی خود، دسترسی عاملهای هوش مصنوعی شخص ثالث مانند Muse متا را مسدود کرد. در مقابل، Shopify با پذیرش معماری توکنمحور، درهای خود را به روی…

پژوهشهای سری AIRA در متا نشان میدهد که عملکرد عاملهای هوشمند بیش از آنکه به مدل وابسته باشد، به محیط تمرین و سیاستهای جستوجو بستگی دارد. این رویکرد منجر به کسب رتبه هشتم در…

امیت ساهی، دانشمند علوم کامپیوتر، هشدار میدهد که پیشرفتهای ریاضی هوش مصنوعی در حال عبور از توان فهم انسان است. او خواستار ایجاد یک «ذخیره استراتژیک» از متخصصان ریاضی است تا تمدن…

اجرای عاملهای هوش مصنوعی در محیط عملیاتی نیازمند یک لایه کنترل برای جلوگیری از هزینههای سرسامآور و افت کیفیت است. آزمایشهای جدید نشان میدهد که استفاده از مانیفستهای توصیفی و…

آموزش عاملهای هوش مصنوعی به دو متدولوژی مجزا تقسیم شده است: دوجوهای RL که وزنهای مدل را تغییر میدهند و دوجوهای Harness که قوانین خارجی را بهینه میکنند. در حالی که روش اول…