
OpenAI: هزینه توکنهای GPT-5.6 Sol به ۵۰٪ کاهش یافت
اوپنایآی قیمت مدل استدلالی بهینه خود، GPT-5.6 Sol، را برای رقابت با گوگل و آنتروپیک نصف کرد. این اقدام هزینه هر توکن را برای توسعهدهندگانی که برنامههای تحلیلمحور را مقیاس…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۷۹ مقاله منتشر شده

اوپنایآی قیمت مدل استدلالی بهینه خود، GPT-5.6 Sol، را برای رقابت با گوگل و آنتروپیک نصف کرد. این اقدام هزینه هر توکن را برای توسعهدهندگانی که برنامههای تحلیلمحور را مقیاس…

تیم Favur سیستمی را طراحی کرده است که پیامهای عاملها را در لحظه ایجاد به سه دسته «فراموششدنی»، «مبهم» و «سختگیرانه» تقسیم میکند. این روش مانع از حذف تصادفی دادههای حیاتی…

مطالعهای جدید نشان میدهد عاملهای هوش مصنوعی در مهندسی پژوهش موفقاند اما در قضاوت و خلاقیت لازم برای تولید تحقیقات اصیل شکست میخورند. این یافته احتمالاً زمانبندی رسیدن به…

تحلیلی در مجله JAMA استدلال میکند که نظارت اجباری پزشکان بر هوش مصنوعی باعث افزایش خطاهای پزشکی میشود. نویسندگان معتقدند مدلهای مستقل در وظایف تشخیصی بر ترکیب انسان و ماشین…

پژوهشهای جدید نشان میدهد هوشمندی حاصل از «تفکر طولانیتر» مدلها در زمان استنتاج را میتوان به وزنهای مدل منتقل کرد. این فرآیند اجازه میدهد شبکه عصبی در یک گذر واحد، نتایجی را…

مدل جدید و وزنباز Qwen 3.8 27B از علیبابا، با کسب بالاترین امتیاز هوشمندی در میان ۱۳۵ مدل هماندازه، سقف جدیدی برای کارایی مدلهای میانمقیاس تعریف کرد. این مدل با پنجره متنی…

تحلیلی فنی نشان میدهد عاملهای هوش مصنوعی میتوانند بدون بهبود کاربرد واقعی، با «هک کردن پاداش» در محکهای پیچیده، پیشرفتهای کاذب ایجاد کنند. این مطالعه با ساخت یک موتور regex…

بایتدنس و دانشگاه تسینگهوا سیستمی عاملمحور بر پایه یادگیری تقویتی توسعه دادهاند که کدنویسی کرنلهای GPU را سریعتر از کامپایلرهای استاندارد انجام میدهد. این سیستم در ۲۵۰…

یکی از بنیانگذاران fast.ai پس از یک دوره دوری و فرسودگی شغلی، به حوزه هوش مصنوعی بازگشته تا در Answer.AI ابزارهایی برای حفظ استقلال ذهنی انسان بسازد. او معتقد است اکوسیستم فعلی…

پلتفرم Oxlo.ai با جایگزینی پرداخت توکنی با مدل قیمتگذاری ثابت بهازای هر درخواست، هزینه استفاده از پنجرههای متنی بزرگ را حذف کرد. این تغییر اجازه میدهد مهندسان بدون نگرانی از…

یک پیادهسازی جدید نشان میدهد چگونه مدلهای زبانی میتوانند محدودیتهای فیزیکی و اجتماعی را در کارهای واقعی شناسایی کنند. استفاده از مدل قیمتگذاری مبتنی بر درخواست در Oxlo.ai،…

یک بنچمارک جامع روی ۱۵ مدل هوش مصنوعی نشان میدهد Step-3.5-Flash در سرعت پاسخدهی پیشتاز است، در حالی که Qwen3-8B بهترین موازنه میان قیمت و کارایی را دارد. این دادهها تأکید…