
«بدون تغییر در کد»؛ ادغام مدلهای DeepSeek در محیط Codex
شرکت DeepSeek رابط برنامهنویسی خود را بهروزرسانی کرد تا با فرمت Responses API سازگار شود. این تغییر به توسعهدهندگانی که از SDKهای OpenAI استفاده میکنند اجازه میدهد بدون…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۷ مقاله منتشر شده

شرکت DeepSeek رابط برنامهنویسی خود را بهروزرسانی کرد تا با فرمت Responses API سازگار شود. این تغییر به توسعهدهندگانی که از SDKهای OpenAI استفاده میکنند اجازه میدهد بدون…

بررسی مجدد تاریخچه هوش مصنوعی نشان میدهد کتاب سال ۱۹۶۹ مینسکی و پاپرت، محدودیتهای سیستمهای تکلایه را برجسته کرد، نه غیرممکن بودن شبکههای چندلایه را. زمستان هوش مصنوعی بیشتر…

شرکت xAI مدل Grok 4.6 را با تمرکز بر عاملهای خودکار و کدنویسی پیچیده عرضه کرد. این مدل در شاخص Intelligence Analysis با رقیب اصلی خود برابری میکند و از طریق API در دسترس است.

تیم Qwen علیبابا مدل Qwen3.8 را با معماری MoE و ۲.۴ تریلیون پارامتر برای وظایف پیچیده و عاملمحور منتشر کرد. این مدل با هدف ارتقای تواناییهای کدنویسی و پژوهشهای تخصصی،…

پژوهشی جدید نشان میدهد لایههای «پاکسازی» متن در مسیر تبدیل گفتار به نوشتار، با حذف جزئیات ساختاری، عملکرد مدلهای هوش مصنوعی را بهشدت تخریب میکنند. این افت کیفیت در وظایف…

تحلیل پیشرفتهای اخیر OpenAI نشان میدهد مدلهای زبانی برای یافتن مثالهای نقض و اثباتهای وجودی از طریق آزمون و خطای سریع بهینه شدهاند. این مدلها بهجای استدلال مفهومی عمیق، بر…

یک چارچوب جدید با جایگزینی روشهای سنتی تاگوچی با بهینهسازی مبتنی بر مدلهای زبانی، هزینه آزمایشات صنعتی را از ۸۰۰ هزار ین به ۳ هزار ین رساند. این متد با تبدیل طراحی محصول به یک…

چارچوب جدید Fusion-MOA با ایجاد یک «کمیته فنی» از مدلهای کوچک و بازمتن، در وظایف مهندسی پیچیده از مدلهای غولپیکر ابری پیشی گرفت. این رویکرد ثابت میکند سازماندهی هوشمند مدلها…

پلتفرم Paradigm شبیهسازی جدیدی را برای تحلیل اقتصاد «خودبهسازی بازگشتی» مدلهای هوش مصنوعی عرضه کرد. این ابزار نشان میدهد حتی با دسترسی به هوش نامحدود، کمبود داده و توان…

یک عامل امنیتی جدید با استفاده از ساختار دو مرحلهای «پوسته-عمق»، کدهای پایتون را بازرسی میکند. این سیستم با اجبار مدل دوم به نقد یافتههای مدل اول، آسیبپذیریهای پیچیده را…

یک مدل آزمایشی از شرکت آنتروپیک با استفاده از یک سامانه چندعاملی، موفق شد کران پایین راهکارهای فرضیه ریمان را افزایش دهد. این دستاورد حاصل بررسی ۶۵۰ ایده مختلف طی ۳۶ ساعت محاسبات…

استقرار مدلهای استدلالی عمیق بهدلیل گسترش توکنها در زنجیره تفکر، هزینههای غیرقابلپیشبینی ایجاد میکند. Oxlo.ai با جایگزینی صورتحساب توکنمحور با هزینه ثابت بهازای هر…