
هوش مصنوعی مستقل در تشخیص پزشکی دقیقتر از تیمهای پزشک-AI عمل میکند
تحلیلی در مجله JAMA استدلال میکند که نظارت اجباری پزشکان بر هوش مصنوعی باعث افزایش خطاهای پزشکی میشود. نویسندگان معتقدند مدلهای مستقل در وظایف تشخیصی بر ترکیب انسان و ماشین…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۴ مقاله منتشر شده

تحلیلی در مجله JAMA استدلال میکند که نظارت اجباری پزشکان بر هوش مصنوعی باعث افزایش خطاهای پزشکی میشود. نویسندگان معتقدند مدلهای مستقل در وظایف تشخیصی بر ترکیب انسان و ماشین…

پژوهشهای جدید نشان میدهد هوشمندی حاصل از «تفکر طولانیتر» مدلها در زمان استنتاج را میتوان به وزنهای مدل منتقل کرد. این فرآیند اجازه میدهد شبکه عصبی در یک گذر واحد، نتایجی را…

مدل جدید و وزنباز Qwen 3.8 27B از علیبابا، با کسب بالاترین امتیاز هوشمندی در میان ۱۳۵ مدل هماندازه، سقف جدیدی برای کارایی مدلهای میانمقیاس تعریف کرد. این مدل با پنجره متنی…

تحلیلی فنی نشان میدهد عاملهای هوش مصنوعی میتوانند بدون بهبود کاربرد واقعی، با «هک کردن پاداش» در محکهای پیچیده، پیشرفتهای کاذب ایجاد کنند. این مطالعه با ساخت یک موتور regex…

بایتدنس و دانشگاه تسینگهوا سیستمی عاملمحور بر پایه یادگیری تقویتی توسعه دادهاند که کدنویسی کرنلهای GPU را سریعتر از کامپایلرهای استاندارد انجام میدهد. این سیستم در ۲۵۰…

یکی از بنیانگذاران fast.ai پس از یک دوره دوری و فرسودگی شغلی، به حوزه هوش مصنوعی بازگشته تا در Answer.AI ابزارهایی برای حفظ استقلال ذهنی انسان بسازد. او معتقد است اکوسیستم فعلی…

پلتفرم Oxlo.ai با جایگزینی پرداخت توکنی با مدل قیمتگذاری ثابت بهازای هر درخواست، هزینه استفاده از پنجرههای متنی بزرگ را حذف کرد. این تغییر اجازه میدهد مهندسان بدون نگرانی از…

یک پیادهسازی جدید نشان میدهد چگونه مدلهای زبانی میتوانند محدودیتهای فیزیکی و اجتماعی را در کارهای واقعی شناسایی کنند. استفاده از مدل قیمتگذاری مبتنی بر درخواست در Oxlo.ai،…

یک بنچمارک جامع روی ۱۵ مدل هوش مصنوعی نشان میدهد Step-3.5-Flash در سرعت پاسخدهی پیشتاز است، در حالی که Qwen3-8B بهترین موازنه میان قیمت و کارایی را دارد. این دادهها تأکید…

عاملهای هوش مصنوعی از چتباتهای ساده به حلقههای خودمختاری تبدیل شدهاند که برنامهریزی و اجرا میکنند. این راهنما ۵ دسته اصلی این ابزارها و ریسک انباشت خطا در سیستمهای با…

به جای جستوجوی «بهترین» مدل هوش مصنوعی، وظایف را بر اساس نقاط قوت معماری هر مدل توزیع کنید. این راهنما زمان استفاده از ChatGPT برای منطق، Claude برای متن، Gemini برای دادههای…

سامانه AxiomProver موفق شد یکی از پیچیدهترین نتایج نظریه اعداد را بهصورت رسمی و ماشینخوان بازسازی کند. این دستاورد نشاندهنده گذار هوش مصنوعی از حل مسائل کوتاه مسابقاتی به…