
دلتای احساسی در برابر برچسبهای مثبت/منفی در پردازش زبان طبیعی
پردازش زبان طبیعی در بازارهای مالی از برچسبهای ساده مثبت/منفی فاصله گرفته و بر «دلتای احساسی» یا تغییر لحن مدیران تمرکز کرده است. مدلهای جدید با تفکیک پاسخهای بداهه از متنهای…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۳ مقاله منتشر شده

پردازش زبان طبیعی در بازارهای مالی از برچسبهای ساده مثبت/منفی فاصله گرفته و بر «دلتای احساسی» یا تغییر لحن مدیران تمرکز کرده است. مدلهای جدید با تفکیک پاسخهای بداهه از متنهای…

پژوهش جدید انویدیا نشان میدهد که «هارنس» یا همان چارچوب نرمافزاری پیرامون مدل، در انجام تکالیف پیچیده بسیار حیاتیتر از خودِ مدل است. این شرکت با افزودن یک لایه نظارتی، توانست…

دیپسیک یک مدل چندوجهی آزمایشی معرفی کرد که درک تصویر را با معماری سریع Flash ترکیب میکند. این مدل بهطور خاص برای گردشکارهای عاملمحور بهینه شده و در وظایف استدلال و استفاده از…

پروژه PlannerCritic نشان داد که مدلهای زبانی در نقش بازبین، برنامههای ایمن را بهدلیل وسواس در جزئیات مسدود میکنند. توسعهدهندگان با جایگزینی قضاوت مدل با یک لایه کدنویسی قطعی…

یک چارچوب مفهومی جدید استدلال میکند که هوش واقعی در ساختار ایستا و فشردهشدهی وزنهای مدل نهفته است، نه در خروجیهای متنی. این دیدگاه توضیح میدهد چرا مدلهای کوچکتر و بهینهتر…

پژوهشی روی ۲۷ هزار دانشآموز چینی نشان میدهد ابزارهای هوش مصنوعی با ایجاد «تله وابستگی»، نمرات تکالیف را بالا برده اما یادگیری عمیق و نتایج آزمونهای کتبی را بهشدت کاهش دادهاند.

مدلهای زبانی بزرگ کیفیت استدلال خود را تا سقف توکنهای اعلامشده حفظ نمیکنند. عملکرد این مدلها بهصورت تدریجی کاهش مییابد و نقطهٔ بحرانی کاربردپذیری معمولاً در ۶۰٪ ظرفیت رخ…

تحلیل شاخص هوش مصنوعی Artificial Analysis نشان میدهد هزینه دستیابی به سطوح مشخصی از قابلیتهای مدلها با سرعتی شتابان در حال سقوط است. این روند، وظایف حجیم را از پروژههای…

جایگزینی منابع دستاول با خلاصههای تولیدشده توسط هوش مصنوعی، «اصطکاک شناختی» لازم برای تفکر انتقادی را از بین میبرد. این روند خطر کاهش توانایی انسان در راستیآزمایی اطلاعات و…

گوگل دیپمایند با همکاری Fenris Creations، عاملهای هوش مصنوعی خود را در محیط پیچیده و اقتصادی EVE Online آزمایش میکند تا محدودیتهای حافظه و برنامهریزی بلندمدت را برطرف کند.

شرکتهای OpenAI و DeepSeek با متنباز کردن «هارنس» یا همان لایههای مدیریت ابزار و وضعیت، رقابت را از معماری سیستم به قدرت مدلهای زیربنایی منتقل کردند. این اقدام اجازه میدهد…

تیم Qwen علیبابا با معرفی AVA-Encoder، نمایش ویدیوها را از تنسورهای متراکم به گرافهای دانش تبدیل کرد. این رویکرد علاوه بر افزایش چشمگیر کیفیت بازسازی، امکان ویرایش معنایی محتوا…