
CLM-8B: تصمیمگیری عاملهای هوش مصنوعی ۹ برابر سریعتر شد
مدل وزنباز CLM-8B با جایگزینی تولید متن با سیستم امتیازدهی اقدامات، تأخیر در تصمیمگیری عاملهای هوش مصنوعی را بهشدت کاهش داد. این مدل در نقش تأییدکننده کدنویسی، نتایجی فراتر از…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۷۳ مقاله منتشر شده

مدل وزنباز CLM-8B با جایگزینی تولید متن با سیستم امتیازدهی اقدامات، تأخیر در تصمیمگیری عاملهای هوش مصنوعی را بهشدت کاهش داد. این مدل در نقش تأییدکننده کدنویسی، نتایجی فراتر از…

شرکت SpaceXAI مدل Grok 4.7 را با تمرکز بر کدهای پیچیده و وظایف عاملمحور معرفی کرد. این مدل با وجود افزایش چشمگیر توان استدلال و پنجره متنی ۵۰۰ هزار توکنی، قیمت استنتاج خود را…

یک محک جدید در Kaggle نشان میدهد که مدلهای گوگل و OpenAI در تفسیر احساسات پنهان برتر هستند. در حالی که DeepSeek در منطق و کدنویسی میدرخشد، در درک لایههای عاطفی متن شکست خورده…

گزارش جامع Artificial Analysis از مدل Mercury 2.5، تمرکز ارزیابیها را از هوش خام به «هوش در هر دلار» تغییر داد. این تحلیل با استفاده از شاخصهای جدید، کارایی عاملمحور و…

ابزار جدید Atlarix Auto با تحلیل هر گام از فرآیند برنامهنویسی، بهینهترین مدل هوش مصنوعی را برای آن مرحله انتخاب میکند. این عامل دسکتاپ با حذف نیاز به مدیریت کلیدهای API و…

چارچوب LensVLM با استفاده از مکانیزم گسترش انتخابی، اجازه میدهد مدلهای VLM تصاویر بهشدت فشرده را بدون افت دقت پردازش کنند. این سیستم با شناسایی نواحی حیاتی و بزرگنمایی آنها،…

اوپنایآی با معرفی MentalHealthBench، معیاری تخصصی شامل ۱۲۱۵ گفتگو برای ارزیابی عملکرد مدلهای هوش مصنوعی در سناریوهای سلامت روان ارائه کرد. این ابزار با استفاده از معیارهای…

شرکت TypeSafe AI مدل Jev را معرفی کرد؛ سیستمی که بهجای تولید متن، تصمیمات احتمالی را بهصورت موازی میگیرد. این معماری با حذف توکنسازیهای متوالی، سرعت و هزینهٔ لایههای…

مهندسان آنتروپیک فاش کردند که مدلهای جدید کلود بهدلیل تمرکز بر ریاضیات و کدنویسی، لحنی «ماشینمحور» پیدا کردهاند. این تغییر باعث شده است مدلها بهجای انسان، برای سایر هوشهای…

کتابخانه متنباز Jevper با تبدیل پاسخهای متنی مدلهای زبانی به امتیازات اطمینان و احتمالات ساختاریافته، امکان طبقهبندی دقیق دادهها را فراهم میکند. این ابزار با پشتیبانی از…

یافتههای جدید گوگل، استنفورد و TypeSafe نشان میدهد هوش مصنوعی بدون رابطی متناسب با هر وظیفه، عملاً بیفایده است. تمرکز صنعت اکنون از افزایش قدرت خام مدلها به سمت نحوه تعامل…

یک مقاله فنی جدید مفهوم «ناخوانایی زبانی» را تعریف میکند؛ شکافی که نشان میدهد مدلهای زبانی میتوانند در لایه محاسباتی کاری کنند و در لایه بیان، چیز دیگری بگویند. این یافته ثابت…