
تیم Qwen: افزایش ۲۰.۷ امتیازی کیفیت ویدیو با AVA-Encoder
تیم Qwen علیبابا با معرفی AVA-Encoder، نمایش ویدیوها را از تنسورهای متراکم به گرافهای دانش تبدیل کرد. این رویکرد علاوه بر افزایش چشمگیر کیفیت بازسازی، امکان ویرایش معنایی محتوا…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۴ مقاله منتشر شده

تیم Qwen علیبابا با معرفی AVA-Encoder، نمایش ویدیوها را از تنسورهای متراکم به گرافهای دانش تبدیل کرد. این رویکرد علاوه بر افزایش چشمگیر کیفیت بازسازی، امکان ویرایش معنایی محتوا…

اوپنایآی حالت «فوقسریع» مدل GPT-5.6 Sol را معرفی کرد که با سرعت ۷۵۰ توکن در ثانیه پاسخ میدهد. این جهش سرعت، عاملهای هوش مصنوعی را از چتباتهای خطی به موتورهای استدلالی با…

مدل جدید علیبابا، Qwen3.8-27B، تعادلی میان اندازه و قدرت ایجاد کرده است که اجازه میدهد یک میلیون توکن در یک GPU ردهبالا جای بگیرد. این مدل در استخراج دادههای ساختیافته و…

پژوهشگران MIT با توسعه یک خط لوله مبتنی بر مدلهای زبانی بزرگ، توانستند با تحلیل هفتهها مکالمات واقعی از طریق ساعتهای هوشمند، پاسخهای احتمالی بعدی کاربران را پیشبینی کنند. این…

بررسی اسناد مالی نشان میدهد مدلهای زبانی بزرگ حتی هنگام خوانش اشتباه دادهها، سطح اطمینان بالایی گزارش میکنند. راهکار این مشکل نه در مهندسی پرامپت، بلکه در پیادهسازی بررسیهای…

پژوهش جدید دانشگاه استنفورد نشان میدهد مدلهای زبانی کوچک (SLM) که روی سختافزار محلی اجرا میشوند، بهسرعت در حال پر کردن شکاف عملکرد با مدلهای ابری هستند. این تغییر میتواند…

اتکای صرف به امتیازات کلی بنچمارکها برای انتخاب مدل زبانی اشتباه است. معماریهای «آگاه از وظیفه» با ایجاد یک لایه مسیریابی، هر درخواست را به مدلی میسپارند که بهترین توازن میان…

ترنس تائو، ریاضیدان برجسته، هشدار میدهد که تولید انبوه اثباتها توسط هوش مصنوعی میتواند توانایی انسان در بازبینی و درک منطق ریاضی را از بین ببرد. او معتقد است اولویت باید از…

الگوی ReAct با ترکیب زنجیرههای استدلالی و گامهای عملیاتی، به عاملهای هوش مصنوعی اجازه میدهد پیش از اقدام، «فکر» کنند. این چرخه با تکیه بر دادههای خارجی، نرخ توهم مدلها را…

مدل Grok 4.6 شرکت xAI اکنون در بیش از ۳۰ منطقه AWS در دسترس است. این مدل با معرفی سطح استدلال xhigh قدرت تحلیل را افزایش داده، اما پنجره متنی کوچکتر و قیمت بالاتری نسبت به نسل…

پلتفرم Zyctra مجموعهای از موتورهای هوش مصنوعی را برای بهینهسازی رزومه و آمادگی در مصاحبههای تخصصی حسابداری و مدیریت پروژه عرضه کرد. این سامانه با تمرکز بر استانداردهای استخدامی…

مدل جدید علیبابا با وجود اندازه کوچک، عملکردی در سطح مدلهای پیشرو در کدنویسی و اتوماسیون سیستمعامل ارائه میدهد. این مدل با معماری ترکیبی و لایسنس Apache 2.0، دسترسی به…