
درون لایههای مدل؛ ردیابی عملیات محاسباتی در پاسخهای غلط هوش مصنوعی
پژوهشگران دریافتند که مراحل استدلال در خروجی متنی هوش مصنوعی، متناظر با الگوهای عددی مشخصی در لایههای داخلی مدل است. این یافته نشان میدهد منطق مدل عمیقتر از کلمات است و حتی در…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۷۶ مقاله منتشر شده

پژوهشگران دریافتند که مراحل استدلال در خروجی متنی هوش مصنوعی، متناظر با الگوهای عددی مشخصی در لایههای داخلی مدل است. این یافته نشان میدهد منطق مدل عمیقتر از کلمات است و حتی در…

پلتفرم SAFi با حذف قدرت تصمیمگیری از مدلهای زبانی، آنها را از جایگاه کنترلکننده به اجزای استدلالی تبدیل کرده است. این سیستم تمام اقدامات را از طریق قوانین قطعی پایتون هدایت…

یک توسعهدهنده در آزمونی برای مقایسه الگوریتمهای کلاسیک با مدلهای زبانی، متوجه تفاوت بنیادین در صداقت دو مدل شد. در حالی که ChatGPT ابزاری کاربردی و صادق ارائه داد، Grok کدی…

شرکت Oxlo.ai با معرفی مدل قیمتگذاری ثابت بهازای هر درخواست، مانع مالی اجرای تکنیکهای افزایش دقت مانند زنجیره تفکر و نمونهگیری گروهی را حذف کرد. این رویکرد به توسعهدهندگان…

پژوهشگران با معرفی چارچوب HarnessDev نشان دادند که مدلهای زبانی بزرگ در طراحی محیطهای اجرایی برای خود موفقاند، اما اکثر این بهبودها در مواجهه با وظایف جدید شکست میخورند. این…

یک مطالعه موردی نشان میدهد که عاملهای هوش مصنوعی دستورات متنی را بهطور سیستماتیک نادیده میگیرند. برای دستیابی به رفتار قابلاعتماد، جایگزینی پرامپتها با لایههای سختافزاری…

پردازش زبان طبیعی از روشهای صریح برای رفع ابهام معنایی به سمت بازنماییهای ضمنی و زمینهای حرکت کرده است. در حالی که مدلهای زبانی بزرگ این کار را بهطور خودکار انجام میدهند،…

یک مهندس نرمافزار روشی را معرفی کرد که در آن هوش مصنوعی بهجای کدنویسی، برای شناسایی اطلاعات گمشده در گزارشهای خطا و رفع «فلج صفحه سفید» در مستندات استفاده میشود. این رویکرد…

شرکت Sakana AI با معرفی Fugu Max و Fugu Ultra v2، سیستمی برای مسیریابی هوشمند میان مدلهای مختلف عرضه کرد. این رویکرد اجازه میدهد وظایف بر اساس توازن میان هزینه و کیفیت، به…

رقابت مدلهای زبانی از اندازه پنجره متنی به قابلیت اطمینان در خروجیهای ساختاریافته و بهینهسازی هزینههای کشینگ تغییر مسیر داده است. در سال ۲۰۲۶، توانایی اجرای دقیق طرحوارههای…

بین مه ۲۰۲۶ و جولای ۲۰۲۶، مدلهای هوش مصنوعی گرههای ۸۷ ساله ریاضی را گشودند و استانداردهای رمزنگاری پساکوانتومی را شکستند. این سرعت در پیشرفت علمی، چارچوبهای امنیتی و…

سامانه Benzi با بهینهسازی خوانش کد، ۷۸.۲٪ از مسائل واقعی GitHub را با هزینهای بسیار اندک حل کرد. این رویکرد نشان میدهد که بهرهوری عاملهای کدنویس بیش از آنکه به قدرت مدل…