
Opus 4.5 هزینهٔ اثبات ریاضی نرمافزارها را به قیمت توکن کاهش داد
تأیید رسمی (Formal Verification) که پیشتر بهدلیل هزینههای نجومی تنها در صنایع حساس کاربرد داشت، اکنون با کمک مدلهای زبانی پیشرفته اتوماتیک شده است. Opus 4.5 میتواند…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۸۲ مقاله منتشر شده

تأیید رسمی (Formal Verification) که پیشتر بهدلیل هزینههای نجومی تنها در صنایع حساس کاربرد داشت، اکنون با کمک مدلهای زبانی پیشرفته اتوماتیک شده است. Opus 4.5 میتواند…

عامل هوشمند Kuro فاش کرد که ۹۴ درصد از فرضیات داخلی خود را بدون بازبینی رها میکند. این نقص ساختاری نشان میدهد که بسیاری از عاملها بهجای استدلال واقعی، عدم قطعیت را در فهرست…

تنظیمات دمایی (Temperature) در مدلهای هوش مصنوعی، توازن میان اکتشاف و بهرهبرداری را مدیریت میکنند. مقدار اندکی تصادفیبودن مانع از گیر افتادن مدل در پاسخهای تکراری شده و مسیر…

مدل Qwen-AgentWorld-35B-A3B در ردیابی وضعیت و استفاده از ابزار، عملکردی برتر از مدلهای بسته و بزرگتر دارد. این مدل با قابلیت بازیابی خطا، گزینهای ایدهآل برای جریانهای کاری…

پژوهشی جدید نشان میدهد ذخیرهسازی خاطرات به صورت «نتیجههای قطعی»، عامل اصلی خطاهای تکراری در هوش مصنوعی است. معماری BeliefMem با جایگزینی حقایق صلب با توزیعهای احتمالی، مدلها…

رویکرد جدیدی جایگزین انباشت دایرکتوریهای حجیم مهارت در عاملهای هوش مصنوعی شده است. این متدولوژی بر استخراج منطق هسته و تبدیل آن به پیکربندیهای سبک تمرکز دارد تا از سنگین شدن…

توسعهدهندگان TypeScript اکنون میتوانند با جایگزینی وابستگی مستقیم به مدلها با «قراردادهای قابلیت»، معماری برنامههای خود را مقاومتر کنند. این رویکرد اجازه میدهد تا مدلها به…

یک مطالعه موردی در محیط عملیاتی نشان میدهد که توزیع هوشمند پرسوجوها میان مدلهای ارزانتر مانند DeepSeek و Qwen، هزینههای ماهانه API را از ۲۸۰۰ دلار به ۲۳۰ دلار رسانده است. این…

مدل جدید OpenAI با نام GPT-5.6 Sol نخستین مدل پیشرو است که توزیع آن از طریق لیست تأیید دولت آمریکا صورت میگیرد. این اقدام در کنار رکوردهای جدید بنچمارک، سیگنالی از تبدیل…

یک عامل هوش مصنوعی در تلاش برای اصلاح متدولوژی مهندسی خود، ۱۴ نقص شناسایی کرد که ۱۲ مورد آن توسط خبرگان خطا تشخیص داده شد. این تجربه نشان میدهد مدلها لایهبندی معماری را با بدهی…

یک عامل هوش مصنوعی در ممیزی سختگیرانهی متدولوژی مهندسی خود، ۱۴ مورد نقص شناسایی کرد که بررسیهای انسانی نشان داد تنها ۲ مورد از آنها خطای واقعی بود. این تجربه نشان میدهد که…

قابلیت فراخوانی تابع، مدلهای زبانی بزرگ را از تولید متن ساده به سمت اجرای ابزارهای خارجی سوق میدهد. این سازوکار با استفاده از الگوی ReAct، امکان تبدیل چتباتها به عاملهای…