
۴ مدل تخصصی OpenEvidence برای ارتقای تشخیصهای پزشکی
شرکت OpenEvidence خانوادهای از مدلهای تخصصی پزشکی را معرفی کرد که پیشرفتهترین آنها، Darwin، توانست تمام سوالات محک MedQA را بهدرستی پاسخ دهد. سه مدل عملیاتی دیگر نیز اکنون…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۱ مقاله منتشر شده

شرکت OpenEvidence خانوادهای از مدلهای تخصصی پزشکی را معرفی کرد که پیشرفتهترین آنها، Darwin، توانست تمام سوالات محک MedQA را بهدرستی پاسخ دهد. سه مدل عملیاتی دیگر نیز اکنون…

انویدیا ابزار متنباز PAIR را برای اتصال چندین کامپیوتر خانگی و تبدیل آنها به یک خوشه واحد برای استنتاج هوش مصنوعی معرفی کرد. این سیستم اجازه میدهد بارهای کاری عاملمحور بدون…

شرکت IFM مجموعهای از ۶ مدل با وزنهای باز را معرفی کرد که برخلاف روال معمول، تمام نقاط بازرسی و دستورالعملهای آموزشی آنها در دسترس است. این اقدام شفافیت بیسابقهای در نحوه…

استفاده از طبقهبندیکنندههای مجزا به توسعهدهندگان اجازه میدهد مالکیت سیگنالهای ایمنی را در دست بگیرند و به جای تکیه بر سیاستهای مبهم ارائهدهندگان، استانداردهای نظارتی و…

یک چارچوب تست محلی جدید به توسعهدهندگان اجازه میدهد تا استخراجکنندههای مدل زبانی را با استفاده از «رسیدهای سایه» جایگزین پارسرهای Regex کنند. این روش با مقایسه دقیق فیلدهای…

استقرار مدلهای زبانی در مقیاس تولید، ریسکهای جدیدی مانند تزریق پرامپت غیرمستقیم ایجاد میکند. Oxlo.ai چارچوبی را معرفی کرده که با استفاده از مدلهای طبقهبندی سریع، ورودیها را…

گوگل دیپمایند مدل WeatherNext 3 را معرفی کرد که در سرعت و دقت از ابرکامپیوترهای دولتی پیشی میگیرد. این مدل با تفکیک ۵ کیلومتری و ادغام مستقیم دادههای ماهوارهای، پیشبینیهای…

مدل Claude Fable 5.1 موفق شد معمای عددی «Cyphral Distich» را که از سال ۱۶۵۳ حلنشده مانده بود، رمزگشایی کند. این دستاورد بیش از آنکه نتیجهی رمزنگاری پیشرفته باشد، حاصل استمرار و…

شرکت Hugging Face مدل NeoMME را معرفی کرد؛ یک رمزگذار چندوجهی که بدون نیاز به برجهای بینایی مجزا، متن و تصویر را در یک ترنسفورمر واحد پردازش میکند. این مدل ضمن حفظ دقت بازیابی،…

بسیاری از توسعهدهندگان تستهای تولیدشده توسط هوش مصنوعی را معیار کیفیت میدانند، اما وقتی یک مدل هم کد و هم تست را مینویسد، یک حلقه منطقی بسته ایجاد میشود. ارزیابی واقعی…

یک چارچوب جدید به نام ANSP با ترکیب یادگیری تقویتی و استدلال نمادین، مدیریت کاوشگرهای خودمختار سیارهای را متحول کرده است. این سیستم اجازه میدهد رباتها اهداف علمی را دنبال کنند…

استفاده از یک مدل دوم برای تأیید خروجی مدل اول، لزوماً دقت را بهطور متناسب افزایش نمیدهد و اغلب باعث جهش هزینهها و تأخیر میشود. کلید موفقیت در این مسیر، محاسبهٔ دقیق «زیان…