پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۶ مقاله منتشر شده

نمودار معماری GPT-5.6 Sol در کنترل آزمایش‌های کوانتومی
آموزش کاربردی

عامل‌های GPT-5.6 Sol کالیبراسیون کوانتومی را به‌صورت خودکار مدیریت می‌کنند

پژوهشگران MIT با ترکیب GPT-5.6 Sol و Codex، فرآیند دشوار کالیبراسیون کیوبیت‌ها را خودکار کردند. این سیستم با تحلیل داده‌ها و اجرای اندازه‌گیری‌ها، نیاز به نظارت مداوم انسانی را…

۴ دقیقه خواندن۲
حلقه عامل Claude Code: از پنجره چت تا حلقه اجرایی
آموزش کاربردی

«اجرای مستقل ابزارها»؛ رویکرد آنتروپیک برای حذف تایید کاربر در کدنویسی

آنتروپیک با طراحی یک لایهٔ واسط به نام Harness، مدل‌های زبانی را که ذاتاً حافظه ندارند به عامل‌هایی تبدیل کرده است که می‌توانند به‌صورت مستقل کد بخوانند و تست بگیرند. این معماری…

۵ دقیقه خواندن۱
هشدار NSA، CISA و FBI: شرکت‌های هوش مصنوعی چینی مدل‌های پیشرفته آمریکا را استخراج می‌کنند

آژانس‌های امنیتی آمریکا: شرکت‌های چینی مدل‌های پیشرو را به‌صورت سیستماتیک تقطیر

NSA، CISA و FBI هشدار دادند که شرکت‌های هوش مصنوعی چین با استفاده از تقطیر دانش در مقیاس صنعتی، قابلیت‌های مدل‌های آمریکایی مانند GPT-5 و Claude را استخراج می‌کنند. این استراتژی…

۵ دقیقه خواندن۲
مایکروسافت عامل هوش مصنوعی MDASH را در Azure Government راه‌اندازی کرد

«تأیید هوشمند حفره‌ها»؛ رویکرد جدید مایکروسافت برای کاهش هزینه‌های Audit

مایکروسافت سیستم اسکنر عامل‌محور MDASH را برای شناسایی و تأیید حفره‌های نرم‌افزاری در Azure Government مستقر کرد. این سامانه با جایگزینی استدلال هوش مصنوعی به‌جای تطبیق الگو، نرخ…

۵ دقیقه خواندن۱
لوگوی مروری ۲.۵ با عنوان «آغاز»، نمادی از شروع دوره جدیدی در توسعه هوش مصنوعی.

مدل Mercury 2.5 هوش مصنوعی را ۴۰٪ ارتقا داد اما تأخیر را ثابت نگه داشت

شرکت Inception مدل Mercury 2.5 را به‌عنوان بزرگ‌ترین مدل زبانی مبتنی بر انتشار معرفی کرد که ۴۰٪ هوشمندتر از نسل قبل است. این مدل با توان عملیاتی ۱۱۰۷ توکن در ثانیه، برای کاربردهای…

۴ دقیقه خواندن۳
نکات پرامپت‌نویسی GPT-6 آسترا: فهرست کلمات ممنوعه و راهنمای بهینه‌سازی پرسش‌ها

آیا ابزارهای نظارتی می‌توانند با سرعتِ رشد هوش بازگشتی همگام شوند؟

اوپن‌ای‌آی به هدف ایجاد «کارآموز پژوهشی خودکار» دست یافت که اکنون بیش از سه برابر نیروی انسانی کار می‌کند. با این حال، مدیران شرکت هشدار می‌دهند که ابزارهای نظارتی از سرعت رشد این…

۵ دقیقه خواندن۱
مسئله هزاره‌ای معادلات ناویر-استوکس: بررسی وجود و همواری راه‌حل‌ها

سامانهٔ چندعاملی OpenAI معمای ۹۰ سالهٔ معادلات ناویر-استوکس را حل کرد

یک سیستم داخلی در OpenAI با اثبات ریاضی نشان داد که حرکت سیالات سه‌بعدی می‌تواند در زمان محدود به تکینگی برسد. این دستاورد که یکی از هفت مسئلهٔ جایزهٔ هزاره است، جهشی عظیم در…

۷ دقیقه خواندن۲
آسیب‌پذیری‌ها را پیدا کرد. بیشترشان اصلاً وجود نداشتند.
آموزش کاربردی

محدودیت‌های مدل‌های زبانی در ممیزی خودکار کد و راهکار جایگزین

استفاده از مدل‌های زبانی برای یافتن آسیب‌پذیری در کدهای حجیم به‌دلیل تکیه بر الگوهای آماری به‌جای استدلال منطقی، منجر به نتایج متقاعدکننده اما نادرست می‌شود. تنها روش قابل‌اعتماد،…

۲ دقیقه خواندن۲
نمونه اولیه مدل GPT-6 در حال پردازش زبان طبیعی با معماری پیشرفته شبکه عصبی.

OpenAI: مدل Astra پیشرفت چشمگیری در بنچمارک‌های استدلال داشت

اوپن‌ای‌آی مدل Astra را به‌عنوان نخستین عضو خانواده GPT-6 معرفی کرد که به‌جای تولید متن، بر تعامل سریع و خودمختار با نرم‌افزارها تمرکز دارد. این مدل در بنچمارک‌های استدلال پیشرفت…

۵ دقیقه خواندن