پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۱۶ مقاله منتشر شده

معرفی LongCat-2.0 توسط میتوان: مدل باز ۱.۶ تریلیون پارامتری MoE با کانتکست ۱ میلیونی و توجه پراکنده LongCat

«هدف‌گذاری برای مهندسی نرم‌افزار»؛ رویکرد Meituan در توسعه LongCat-2.0

شرکت Meituan مدل LongCat-2.0 را به‌عنوان یک مدل MoE عظیم با هدف مهندسی نرم‌افزار عامل‌محور عرضه کرد. این مدل که کاملاً روی سخت‌افزارهای ASIC بومی آموزش دیده، پنجرهٔ زمینه ۱ میلیون…

۵ دقیقه خواندن
سه مدل زبانی بزرگ را در مسئله مشهور «کارواش: پیاده یا سوار» به بحث گذاشتم تا نکته‌ای را ثابت کنم.
آموزش کاربردیتأییدنشده · منبع منفرد

آیا نقد متقابل مدل‌ها دقت استدلال را در تست‌های منطقی می‌افزاید؟

آزمایشی جدید نشان می‌دهد که واداندن چندین مدل زبانی به بحث و نقد متقابل، توهمات استدلالی را حذف می‌کند. این رویکرد ثابت کرد که فشار رقابتی، پاسخ‌های «تنبلی» مدل‌ها را در تست‌های…

۴ دقیقه خواندن
مدل زبانی که پایتخت ژاپن را پاریس می‌داند: آزمایشی درباره توهمات هوش مصنوعی
آموزش کاربردی

پژوهش فارس علافی: ترکیب Mamba-2 و مدل انتشار پیچیدگی ترنسفورمرها را گرفت

فارس علافی، پژوهشگر ۱۳ ساله، مدلی با ۳۰۰ میلیون پارامتر طراحی کرده که با ترکیب معماری Mamba-2 و مدل انتشار، مشکل تکرار کلمات و پیچیدگی محاسباتی ترنسفورمرها را هدف قرار می‌دهد. این…

۱۰ دقیقه خواندن
داور LLM بیش از حد سهل‌گیر است؛ راه‌حل ارزان: داوری با رد و داوری سه‌جانبه
آموزش کاربردی

گزارش فنی: مدل ردکننده هزینه‌های استنتاج ارزیابی را ثابت نگه داشت

ساختارهای فعلی مدل زبانی به‌مثابه داور به‌دلیل تمایل به تایید، نرخ قبولی کاذب بالایی دارند. الگوی جدید با معرفی یک نقش «ردکننده» متخاصم، تنها موارد مورد مناقشه را به مدل‌های…

۹ دقیقه خواندن
ابزارهای نوشتار دانشگاهی با هوش مصنوعی: راهکارها و ابزارهای برتر
آموزش کاربردی

پرداخت به‌ازای درخواست در برابر توکن؛ راهکار Oxlo.ai برای متون طولانی

پلتفرم Oxlo.ai با جایگزینی مدل پرداخت به‌ازای توکن با مدل پرداخت به‌ازای درخواست، هزینه پردازش مقالات طولانی را تا ۱۰۰ برابر کاهش داده است. این تغییر اقتصادی، ابزارهای تخصصی…

۵ دقیقه خواندن
دانشگاه حقوقی LlamaIndex: بازیابی هوشمند با ابزارهای جستجو، یافتن، خواندن و جستجوی متنی
آموزش کاربردی

بازیابی عامل‌محور در برابر RAG ساده در تحلیل اسناد پیچیده LlamaIndex

LlamaIndex با معرفی legal-kb، مدل جست‌وجوی تک‌مرحله‌ای را با یک «هارنس بازیابی» چندمرحله‌ای جایگزین کرد. این سیستم به عامل‌ها اجازه می‌دهد مانند یک کاربر انسانی با ابزارهای مدیریت…

۵ دقیقه خواندن
آیا می‌توان جایگزینی برای مدل‌های زبانی بزرگ ساخت؟ ۸ ماه، حدود ۲۰۰ آزمایش ناموفق، یک بن‌بست. ۲

دیوارِ اتصال علّی: ۲۰۰ آزمایش شکست‌خورده برای جایگزینی شبکه‌های عصبی

یک تلاش پژوهشی هشت‌ماهه برای ساخت زیرساخت دانشی نمادین و مبتنی بر CPU با شکست مواجه شد. این سیستم نتوانست بدون مدل‌های پیش‌فرض، تجربیات قدیمی را به موقعیت‌های جدید پیوند دهد.

۱۲ دقیقه خواندن
سرپیشین سابق Qwen: تفکر ترکیبی اشتباه بود، عامل‌ها راه‌حل‌اند

تغییر اولویت در Qwen: تفکر عامل‌محور جایگزین استدلال داخلی شد

جونیانگ لین، مدیر فنی سابق پروژه Qwen، معتقد است عصر تک‌گویی‌های داخلی مدل‌ها به پایان رسیده و اکنون معیار موفقیت، توانایی مدل در تعامل پویا با محیط واقعی است. او معماری جدید…

۶ دقیقه خواندن