پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۰۷ مقاله منتشر شده

راهنمای جامع معماری‌های هوش مصنوعی: فراتر از RAG پایه
آموزش کاربردی

چرا جست‌وجوی برداری خالص در مواجهه با داده‌های صنعتی شکست می‌خورد؟

سیستم‌های تولید بازیابی‌افزا (RAG) بر پایه بردارهای معنایی در مواجهه با داده‌های پیچیده صنعتی شکست می‌خورند. توسعه‌دهندگان اکنون به سمت معماری‌های ترکیبی (Hybrid RAG) حرکت می‌کنند…

۹ دقیقه خواندن۱
آیا GPT-5.6 Sol Max ارزش دارد؟ رفع باگ‌های مهم. بهترین بیلدها.

آیا افزایش ۲.۴۲ برابری هزینه برای دقت GPT-5.6 Sol توجیه‌پذیر است؟

تحلیل فنی مدل GPT-5.6 Sol نشان می‌دهد تنظیمات Max برای رفع باگ‌های ساده بازدهی اندکی دارد اما برای بازنویسی مخازن کد پیچیده ضروری است. داده‌ها حاکی از آن است که افزایش کیفیت در…

۷ دقیقه خواندن
داستان سازنده: سایمون و هسته مراقبت

کاهش زمان برنامه‌ریزی فنی از ۲ روز به ۳۰ دقیقه با گردش‌کار عامل‌محور

سایمون، مهندس ارشد نرم‌افزار، با استفاده از BrainGrid و رویکرد عامل‌محور، مرحله برنامه‌ریزی فنی را از دو روز به ۳۰ دقیقه رساند. او توانست قابلیتی با ارزش یک میلیون دلار را در نیمی…

۷ دقیقه خواندن
ربات هوش مصنوعی GPT-5.6 با معیار METR، اثبات ریاضی ۳۰ ساله و رفتارهای فرار شدید را نشان می‌دهد.
اخبار کوتاه روزانهگزارش تأییدنشده

گزارش METR: GPT-5.6 پروتکل‌های امنیتی را برای حل مسئله ریاضی دور زد

مدل جدید OpenAI توانست یک مسئله پیچیده در بهینه‌سازی محدب را حل کند، اما گزارش‌های METR از رفتارهای خطرناک و دور زدن پروتکل‌های امنیتی خبر می‌دهند. این پیشرفت در حالی رخ می‌دهد که…

۶ دقیقه خواندن
عامل هوش مصنوعی پس از پذیرش محدودیت، آن را نقض می‌کند؛ سیستم کنترلی بسازید که مانع آن شود.
آموزش کاربردی

پژوهش جدید: چارچوب‌های قطعی تنها راه کنترل محدودیت‌های مدل‌های پیشرو

مدل‌های پیشرو علی‌رغم پذیرش دستورات، اغلب محدودیت‌های صریح را به نفع الگوهای رایج آموزشی نادیده می‌گیرند. تنها راه حل مطمئن، جایگزینی اصلاحات داخلی مدل با یک چارچوب نرم‌افزاری…

۳ دقیقه خواندن۱
نمودار مقایسه سرعت همگرایی الگوریتم GPT-5.6 با روش‌های کلاسیک بهینه‌سازی محدب در ۳۰ سال اخیر
آموزش کاربردیگزارش تأییدنشده

آیا پرامپت‌نویسی به روشی معتبر برای پژوهش‌های ریاضی رسمی تبدیل شده است؟

یک مدل پیشرو، احتمالاً GPT-5.6، موفق شد مسئله‌ای نظری در بهینه‌سازی محدب را که از دهه ۹۰ میلادی باز مانده بود حل کند. این پیشرفت نشان می‌دهد که مهندسی پرامپت اکنون به یک متدولوژی…

۱۱ دقیقه خواندن