پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۰۹۶ مقاله منتشر شده

رمزگشایی از DeepSeek V4: وقتی حافظه استنتاج ۹۰ درصد سبک‌تر می‌شود

رمزگشایی از DeepSeek V4: وقتی حافظه استنتاج ۹۰ درصد سبک‌تر می‌شود

دیپ‌سیک با معرفی مدل‌های V4-Pro و V4-Flash، معماری جدیدی را برای کاهش چشمگیر هزینه‌های استنتاج ارائه کرد. این مدل‌ها با پنجره بافتی ۱ میلیون توکنی، مسیر را برای ظهور عامل‌های…

۲ دقیقه خواندن
تله‌ی بنچمارک‌ها: چرا GPT-5.5 با وجود رکوردشکنی، ۸۶ درصد توهم می‌زند؟

تله‌ی بنچمارک‌ها: چرا GPT-5.5 با وجود رکوردشکنی، ۸۶ درصد توهم می‌زند؟

مدل جدید OpenAI در حالی که صدرنشین شاخص‌های هوش مصنوعی شده، نرخ توهمات تکان‌دهنده‌ای را ثبت کرده است. این تضاد نشان می‌دهد که قدرت محاسباتی لزوماً به معنای قابلیت اعتماد در دنیای…

۳ دقیقه خواندن
پایان عصر مدل‌های حجیم؛ Qwen3.6-27B قواعد کدنویسی را تغییر داد

پایان عصر مدل‌های حجیم؛ Qwen3.6-27B قواعد کدنویسی را تغییر داد

مدل جدید علی‌بابا با ۲۷ میلیارد پارامتر، مدل غول‌پیکر ۳۹۷ میلیاردی предшеل خود را در بنچمارک‌های کدنویسی شکست داد. این دستاورد ثابت می‌کند که بهینه‌سازی معماری بر حجم عظیم داده‌ها…

۲ دقیقه خواندن
پایان عصر بردارهای معنایی؛ آیا استدلال جایگزین جستجوی شباهت می‌شود؟

پایان عصر بردارهای معنایی؛ آیا استدلال جایگزین جستجوی شباهت می‌شود؟

پلتفرم PageIndex با حذف کامل بردارهای معنایی و جایگزینی آن‌ها با ساختار درختی و استدلال مدل‌های زبانی، بازیابی داده‌ها را دگرگون کرده است. این روش ادعا می‌کند در تحلیل اسناد…

۳ دقیقه خواندن
پایان عصر سرورهای گران‌قیمت: DeepSeek-R1 روی سخت‌افزار خانگی می‌نشیند

پایان عصر سرورهای گران‌قیمت: DeepSeek-R1 روی سخت‌افزار خانگی می‌نشیند

تیم Unsloth با ارائه نسخه‌های بهینه‌شده‌ی DeepSeek-R1، مدل ۶۷۱ میلیارد پارامتری را برای سخت‌افزارهای مصرف‌کننده در دسترس قرار داد. این دستاورد به لطف تکنیک کوانتایزیشن ۱.۵۸ بیتی،…

۳ دقیقه خواندن