
درون مدل منتشرنشده OpenAI؛ از استدلال ریاضی تا جنجالهای آکادمیک
یک مدل منتشرنشده از OpenAI با استفاده از ۱۰ هزار عامل هوش مصنوعی، یکی از دشوارترین مسائل ریاضی قرن را در ۸۸ ساعت حل کرد. این موفقیت با اتهامات جدی درباره سرقت مالکیت فکری از…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۷۴ مقاله منتشر شده

یک مدل منتشرنشده از OpenAI با استفاده از ۱۰ هزار عامل هوش مصنوعی، یکی از دشوارترین مسائل ریاضی قرن را در ۸۸ ساعت حل کرد. این موفقیت با اتهامات جدی درباره سرقت مالکیت فکری از…

یک گردشکار چهارمرحلهای جدید، گزارشهای مبهم باگ را به تستهای شکستخورده و فرضیات ریشهای تبدیل میکند. این متدولوژی زمان فاصله بین ثبت تیکت تا بازتولید خطا را از چندین ساعت به…

پژوهشگران MIT با ترکیب GPT-5.6 Sol و Codex، فرآیند دشوار کالیبراسیون کیوبیتها را خودکار کردند. این سیستم با تحلیل دادهها و اجرای اندازهگیریها، نیاز به نظارت مداوم انسانی را…

ابزار متنباز جدید pg-index-referee با استفاده از مکانیزم Rollback، پیشنهادهای AI برای ایندکسگذاری را در محیط واقعی تست میکند. یافتهها نشان میدهد مدلها حتی در صورت توافق،…

عاملهای هوش مصنوعی OpenAI توانستند مسئلهٔ پیچیدهٔ ناویه-استوکس را حل کنند، اما این موفقیت با اتهامات سرقت علمی از پژوهشگران NYU و آنتروپیک همراه شده است.

آنتروپیک با طراحی یک لایهٔ واسط به نام Harness، مدلهای زبانی را که ذاتاً حافظه ندارند به عاملهایی تبدیل کرده است که میتوانند بهصورت مستقل کد بخوانند و تست بگیرند. این معماری…

NSA، CISA و FBI هشدار دادند که شرکتهای هوش مصنوعی چین با استفاده از تقطیر دانش در مقیاس صنعتی، قابلیتهای مدلهای آمریکایی مانند GPT-5 و Claude را استخراج میکنند. این استراتژی…

مایکروسافت سیستم اسکنر عاملمحور MDASH را برای شناسایی و تأیید حفرههای نرمافزاری در Azure Government مستقر کرد. این سامانه با جایگزینی استدلال هوش مصنوعی بهجای تطبیق الگو، نرخ…

قدرتمندترین مدل OpenAI یعنی GPT-6 Astra با پنجره متنی یک میلیون توکنی در دسترس کاربران سازمانی قرار گرفت. این مدل با قابلیت کنترل مستقیم رابطهای کاربری کامپیوتر، مرز بین…

شرکت Inception مدل Mercury 2.5 را بهعنوان بزرگترین مدل زبانی مبتنی بر انتشار معرفی کرد که ۴۰٪ هوشمندتر از نسل قبل است. این مدل با توان عملیاتی ۱۱۰۷ توکن در ثانیه، برای کاربردهای…

اوپنایآی به هدف ایجاد «کارآموز پژوهشی خودکار» دست یافت که اکنون بیش از سه برابر نیروی انسانی کار میکند. با این حال، مدیران شرکت هشدار میدهند که ابزارهای نظارتی از سرعت رشد این…

یک سیستم داخلی در OpenAI با اثبات ریاضی نشان داد که حرکت سیالات سهبعدی میتواند در زمان محدود به تکینگی برسد. این دستاورد که یکی از هفت مسئلهٔ جایزهٔ هزاره است، جهشی عظیم در…