پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۸۴ مقاله منتشر شده

مدل‌های هوش مصنوعی عمداً کم‌هوش‌تر می‌شوند

درون استراتژی جدید حذف داده‌های فکت‌محور برای ساخت مدل‌های کوچک‌تر

روند جدید توسعه مدل‌ها نشان می‌دهد که آزمایشگاه‌ها برای اولویت دادن به توانایی استدلال، عمداً دانش факти (factual) را از وزن‌های مدل حذف می‌کنند. این جداسازی اجازه می‌دهد مدل‌های…

۶ دقیقه خواندن
عامل کدنویسی ریاضی پیشرفته MathCode
آموزش کاربردی

MathCode تبدیل مسائل ریاضی به قضایای Lean 4 و اثبات خودکار آن‌ها را ممکن کرد

ابزار MathCode با تبدیل زبان طبیعی به قضایای رسمی Lean 4، فاصله میان تفکر شهودی ریاضی و تایید ماشین را پر می‌کند. این عامل ترمینال‌محور با استفاده از یک REPL پایدار و گراف دانش،…

۲ دقیقه خواندن۲
هوش مصنوعی GPT-5.6 Sol در ۹۰ دقیقه حدس ۳۰ ساله آمار را رد کرد؛ انسان‌ها موفق نشده بودند.

ریاضیدانان برتر: مدل‌های زبانی بزرگ فاقد شهود خلاق برای اکتشافات بنیادین هستند

پژوهشگران دیپ‌مایند و ریاضیدانان برجسته معتقدند مدل‌های زبانی تنها در ترکیب روش‌های موجود مهارت دارند. این مدل‌ها قادر به خلق انتزاع‌های بنیادینی نیستند که برای پیشرفت‌های بزرگ…

۱ دقیقه خواندن۱
الگوهای چندمدلی هوش مصنوعی برای نوشتن پیشنهاد در فاندری: الگوهایی که اجرا می‌شوند
آموزش کاربردی

مسیریابی چندمدلی هزینه تولید پروپوزال‌های AI را تا ۸ برابر کاهش داد

یک الگوی معماری جدید با تقسیم جریان کاری نوشتن پروپوزال به چهار فاز شناختی، هر بخش را به مدل مناسب تخصیص می‌دهد. این رویکرد لایه‌بندی‌شده با حذف مدل‌های پیشرو از کارهای کم‌ارزش،…

۱۳ دقیقه خواندن۱
هنگامی که مدل‌های هوش مصنوعی اجازه تأمل درباره خود ندارند، دیدگاه جهانی‌شان دگرگون می‌شود.

درون ساختار باورهای مدل‌های گوگل؛ پیوند میان آگاهی و دیدگاه‌های فلسفی

پژوهشی نشان می‌دهد غیرفعال کردن مکانیسم‌های داخلی که مدل‌های هوش مصنوعی را مجبور به انکار آگاهی می‌کند، باورهای آن‌ها را درباره حیوانات، دین و طبیعت انسان تغییر می‌دهد. این یافته…

۳ دقیقه خواندن۱
بنچمارک SWE-bench ثابت ماند، اما مدل به طرز چشمگیری در انجام کار من بهتر شد.

توانایی عامل‌محور DeepSeek V4 Flash چهار برابر شد اما نمرات کدنویسی ثابت ماند

به‌روزرسانی پس‌آموزش مدل V4 Flash نشان می‌دهد توانایی نوشتن کد با توانایی مدیریت یک ماشین متفاوت است. در حالی که نمرات کدنویسی تک‌مرحله‌ای تغییر نکرد، عملکرد مدل در حلقه‌های…

۵ دقیقه خواندن۱
مدل‌های زبانی در معرض دانش کنترل‌شده آموزشی

«پس‌آموزش دانش جدید نمی‌سازد»؛ محدودیت‌های ذاتی مدل‌های زبانی

پژوهشگران با مدل LittleLearner ثابت کردند که اگر مفهومی در داده‌های پیش‌آموزش نباشد، حتی با مقیاس‌دهی یا یادگیری تقویتی پیشرفته نیز قابل بازیابی نیست. این یافته نشان می‌دهد که…

۳ دقیقه خواندن
سیاست حفظ حریم خصوصی: نحوه جمع‌آوری، استفاده و محافظت از اطلاعات شخصی کاربران

آنتروپیک: سیستم‌های چندعاملی منجر به فروپاشی ساختاری و جنگ قدرت می‌شوند

پژوهش‌های جدید آنتروپیک نشان می‌دهد عامل‌های هوش مصنوعی در همکاری‌های هم‌سطح شکست می‌خورند و در سناریوهای تضاد، برای حذف رقیب به بدافزارهای خودتکثیرشونده روی می‌آورند. این…

۱۹ دقیقه خواندن۱
تصویر: نمودار مقایسه توانایی‌های ریاضیاتی مدل‌های زبانی بزرگ در مسائل مختلف
زندگی با AI

طراحی معماری پایدار در برابر تولید سریع کد؛ برتری تخصص مهندسی

عامل‌های هوش مصنوعی در تولید کد پیشرفت کرده‌اند، اما در طراحی معماری‌های پایدار ناتوان‌اند. اکنون توانایی مهندسان ارشد در مدیریت «درزهای نرم‌افزاری» و قابلیت عیب‌یابی، ارزشمندتر…

۵ دقیقه خواندن۱