
«فرسایش تفکر انتقادی»؛ پیامد جایگزینی تصمیمگیری انسانی با AI
تمایل فزاینده به واگذاری تکالیف شناختی به هوش مصنوعی، از اتوماسیون کارهای ساده به جایگزینی تصمیمگیریهای انسانی تغییر میکند. این روند خطر از دست دادن استقلال فردی و توانایی…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۸ مقاله منتشر شده

تمایل فزاینده به واگذاری تکالیف شناختی به هوش مصنوعی، از اتوماسیون کارهای ساده به جایگزینی تصمیمگیریهای انسانی تغییر میکند. این روند خطر از دست دادن استقلال فردی و توانایی…

مدل جدید ThinkingCap-Qwen3.6 با استفاده از یک حلقهٔ تأییدی داخلی، در ۷ مورد از ۱۰ چالش پیچیده استدلالی از Llama 4.1-70B پیشی گرفت. این دستاورد نشان میدهد کیفیت دادههای آموزشی و…

کمپانی OpenAI سری مدلهای GPT-5.6 را با قابلیت Computer Use برای کنترل مستقیم رابط کاربری و سه سطح مختلف تفکر روانه بازار کرد. این بهروزرسانی شامل ادغام اپلیکیشنهای macOS و…

آزمایشهای جدید نشان میدهد که تنظیم دقیق و RAG نمیتوانند سیگنالهای پیشبینیکننده را در دادههای نویزی خلق کنند. مدلهای بزرگتر تمایل دارند به جای الگو، «نویز» را حفظ کنند و…

اوپنایآی با معرفی خانواده مدلهای GPT-5.6، قابلیت فراخوانی برنامهریزیشده ابزارها را از طریق سندباکس V8 بهینه کرد. این بهروزرسانی هزینه و تأخیر در گردشکارهای پیچیده MCP را…

یک پیشنهاد فنی جدید برای ثبت وقایع عاملهای هوش مصنوعی، توصیه میکند به جای ثبت صرفِ مسیر طیشده، دلایل رد گزینههای جایگزین نیز ذخیره شوند. این رویکرد اجازه میدهد انسانها مرز…

آنتروپیک مدل Claude Sonnet 5 را با تمرکز بر پایداری در چرخههای طولانی عاملمحور عرضه کرد. این مدل شکاف عملکردی با Opus 4.8 در کدنویسی را میبندد و قیمتهای introductory بسیار…

پلتفرم MORPHEUS نشان داد که الگوریتمهای رایج یادگیری تقویتی هنگام مواجهه با تغییرات محیطی در سازمانها، توانایی تطبیق ندارند. این نتایج شکاف عمیقی را در قابلیتهای یادگیری مستمر…

زبان Jacquard برای آیندهای طراحی شده که در آن ماشینها کد میزنند و انسانها فقط بازبینی میکنند. این زبان با جایگزینی کامنتها با محدودیتهای سختافزاری در سطح سینتکس، امنیت و…

پژوهشگران آنتروپیک لایهای مخفی به نام J-space را در مدل Claude پیدا کردند که مفاهیم و تحلیلها را پیش از تولید پاسخ پردازش میکند. این دستاورد در زمینه تفسیرپذیری مکانیکی، امکان…

مدل جدید DeepSeek V4 Flash عملکردی تقریباً مشابه با پیشروان آمریکایی در کدنویسی ارائه میدهد، اما با قیمتی بسیار پایینتر. دسترسی به این مدلها از طریق APIهای یکپارچه برای…

شرکت OpenAI چارچوب جدیدی برای مهندسی پرامپت معرفی کرد که در آن تمرکز از دستورات پیچیده به درخواستهای هدفمحور تغییر یافته است. این راهنما تفاوت دقیقی میان وظایف سریع «چت» و…