پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۹ مقاله منتشر شده

روتر تصادف‌کرده به امتیاز اطمینان ۰.۹۷ اعتماد کرد؛ نیاز به رأی‌گیری داشت.
آموزش کاربردی

رای‌گیری قطعی در برابر تصمیم‌گیری تک‌بعدی برای اصلاح خروجی‌های مدل

یک تیم توسعه با جایگزینی تصمیم‌گیری تک‌بعدی هوش مصنوعی با یک سیستم رای‌گیری (Voter)، مانع از گم شدن باگ‌های بحرانی در صف‌های اشتباه شد. در این معماری، قوانین قطعی محلی قدرت وتو…

۶ دقیقه خواندن۳
ده ابزار برتر هوش مصنوعی برای آموزش: مقایسه قابلیت‌ها و کاربردها در یادگیری
آموزش کاربردی

۱۰ ابزار هوش مصنوعی که یادگیری و تدریس را در سال ۲۰۲۶ بازتعریف می‌کنند

راهنمای جامع جدیدی، ابزارهای آموزشی هوش مصنوعی را به دو دسته «توتورهای سقراطی» برای تقویت استدلال و «ابزارهای بهره‌وری» برای اتوماسیون برنامه‌ریزی تقسیم کرده است. این تغییر…

۸ دقیقه خواندن
کیوئن ۳.۵ با وجود استدلال مشابه جی‌ال‌ام-۵.۲، ۸۲ درصد واقعیت‌ها را توهم می‌زند

چرا مدل‌های پیشرو در ریاضیات همچنان دچار توهمات گسترده می‌شوند؟

تحلیل‌های فنی جدید نشان می‌دهد آزمایشگاه‌های AI برای افزایش کارایی استدلال، عمداً دانش فکت‌محور را از مدل‌ها حذف می‌کنند. مدل‌هایی مانند Qwen3.5 در ریاضیات پیشرو هستند اما در نبود…

۱۲ دقیقه خواندن
مدل‌های هوش مصنوعی عمداً کم‌هوش‌تر می‌شوند

درون استراتژی جدید حذف داده‌های فکت‌محور برای ساخت مدل‌های کوچک‌تر

روند جدید توسعه مدل‌ها نشان می‌دهد که آزمایشگاه‌ها برای اولویت دادن به توانایی استدلال، عمداً دانش факти (factual) را از وزن‌های مدل حذف می‌کنند. این جداسازی اجازه می‌دهد مدل‌های…

۶ دقیقه خواندن
عامل کدنویسی ریاضی پیشرفته MathCode
آموزش کاربردی

MathCode تبدیل مسائل ریاضی به قضایای Lean 4 و اثبات خودکار آن‌ها را ممکن کرد

ابزار MathCode با تبدیل زبان طبیعی به قضایای رسمی Lean 4، فاصله میان تفکر شهودی ریاضی و تایید ماشین را پر می‌کند. این عامل ترمینال‌محور با استفاده از یک REPL پایدار و گراف دانش،…

۲ دقیقه خواندن۲
هوش مصنوعی GPT-5.6 Sol در ۹۰ دقیقه حدس ۳۰ ساله آمار را رد کرد؛ انسان‌ها موفق نشده بودند.

ریاضیدانان برتر: مدل‌های زبانی بزرگ فاقد شهود خلاق برای اکتشافات بنیادین هستند

پژوهشگران دیپ‌مایند و ریاضیدانان برجسته معتقدند مدل‌های زبانی تنها در ترکیب روش‌های موجود مهارت دارند. این مدل‌ها قادر به خلق انتزاع‌های بنیادینی نیستند که برای پیشرفت‌های بزرگ…

۱ دقیقه خواندن
الگوهای چندمدلی هوش مصنوعی برای نوشتن پیشنهاد در فاندری: الگوهایی که اجرا می‌شوند
آموزش کاربردی

مسیریابی چندمدلی هزینه تولید پروپوزال‌های AI را تا ۸ برابر کاهش داد

یک الگوی معماری جدید با تقسیم جریان کاری نوشتن پروپوزال به چهار فاز شناختی، هر بخش را به مدل مناسب تخصیص می‌دهد. این رویکرد لایه‌بندی‌شده با حذف مدل‌های پیشرو از کارهای کم‌ارزش،…

۱۳ دقیقه خواندن۱
هنگامی که مدل‌های هوش مصنوعی اجازه تأمل درباره خود ندارند، دیدگاه جهانی‌شان دگرگون می‌شود.

درون ساختار باورهای مدل‌های گوگل؛ پیوند میان آگاهی و دیدگاه‌های فلسفی

پژوهشی نشان می‌دهد غیرفعال کردن مکانیسم‌های داخلی که مدل‌های هوش مصنوعی را مجبور به انکار آگاهی می‌کند، باورهای آن‌ها را درباره حیوانات، دین و طبیعت انسان تغییر می‌دهد. این یافته…

۳ دقیقه خواندن
بنچمارک SWE-bench ثابت ماند، اما مدل به طرز چشمگیری در انجام کار من بهتر شد.

توانایی عامل‌محور DeepSeek V4 Flash چهار برابر شد اما نمرات کدنویسی ثابت ماند

به‌روزرسانی پس‌آموزش مدل V4 Flash نشان می‌دهد توانایی نوشتن کد با توانایی مدیریت یک ماشین متفاوت است. در حالی که نمرات کدنویسی تک‌مرحله‌ای تغییر نکرد، عملکرد مدل در حلقه‌های…

۵ دقیقه خواندن۱
مدل‌های زبانی در معرض دانش کنترل‌شده آموزشی

«پس‌آموزش دانش جدید نمی‌سازد»؛ محدودیت‌های ذاتی مدل‌های زبانی

پژوهشگران با مدل LittleLearner ثابت کردند که اگر مفهومی در داده‌های پیش‌آموزش نباشد، حتی با مقیاس‌دهی یا یادگیری تقویتی پیشرفته نیز قابل بازیابی نیست. این یافته نشان می‌دهد که…

۳ دقیقه خواندن