پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۰۹۸ مقاله منتشر شده

تغییرات API دیپ‌سیک | مستندات فنی

مدل V4-Flash دیپ‌سیک در بنچمارک‌های عامل‌محور از نسخه Pro پیشی گرفت

دیپ‌سیک نسخه بتاهای عمومی V4-Flash را منتشر کرد که در وظایف اتوماسیون و کدنویسی، عملکردی فراتر از نسخه Pro-Preview دارد. این مدل بدون تغییر در معماری، تنها از طریق بهینه‌سازی‌های…

۶ دقیقه خواندن۲
راهنمای مسیریابی ۸۰/۲۰: کاهش ۷۰٪+ هزینه عامل هوش مصنوعی بدون افت کیفیت
آموزش کاربردی

«مدل‌های ارزان برای وظایف ساده»؛ راهکاری برای کاهش ۷۰ درصدی مخارج

یک رویکرد جدید در مسیریابی توکن‌ها پیشنهاد می‌کند که حجم کاری عامل‌ها بر اساس دشواری تقسیم شود. با ارسال وظایف ساده به مدل‌های ارزان و رزرو مدل‌های پیشرو برای استدلال‌های پیچیده،…

۵ دقیقه خواندن
نشستی که نمی‌توانی با خود ببری | ارندیل

بلوک‌های رمزنگاری‌شده در برابر متون قابل‌انتقال؛ نبرد برای مالکیت تاریخچهٔ کاربر

ارائه‌دهندگان پیشرو هوش مصنوعی در حال جایگزینی متون قابل‌انتقال با بلوک‌های رمزنگاری‌شده هستند تا کاربران را در اکوسیستم خود حبس کنند. این تغییر باعث می‌شود انتقال تاریخچهٔ کامل…

۱۲ دقیقه خواندن۱
تصویری از یک سیستم ساختاریافته برای نوشتن پرامپت هوشمندانه‌تر با هوش مصنوعی
آموزش کاربردی

موتور شفاف‌سازی متوالی: راهکاری برای حذف چرخه‌های تکرار در خروجی‌های هوش مصنوعی

روش جدید Sequential Clarification Engine با جایگزینی پرامپت‌های ایستا با یک پروتکل چهارمرحله‌ای، توهمات ناشی از فرض‌های غلط را حذف می‌کند. این سیستم با اولویت دادن به تشخیص نیازها…

۸ دقیقه خواندن۱
معیار سنجش حافظه هوش مصنوعی که همه از آن نقل می‌کنند، گفتن «نمی‌دانم» را ممنوع کرده است

محک LOCOMO با حذف پرسش‌های خصمانه، توهمِ دقت در حافظهٔ عامل‌ها را می‌سازد

یک تحلیل فنی فاش کرد که بنچمارک LOCOMO به‌طور عمدی مدل‌ها را از پذیرش «نمی‌دانم» منع کرده و پرسش‌های چالشی را حذف می‌کند. این ساختار باعث ایجاد سقفی مصنوعی از صحت می‌شود که…

۸ دقیقه خواندن۱
مدل تقطیرشده چه چیزی از معلم خود به ارث می‌برد

«جداسازی استدلال از ایدئولوژی»؛ دستاورد جدید در تقطیر مدل‌های زبانی

پژوهشی جدید نشان می‌دهد مدل‌های زبانی می‌توانند توانایی‌های استدلالی پیشرفته را از مدل‌های سانسورشده (مانند مدل‌های چینی) بیاموزند، بدون اینکه محدودیت‌های ایدئولوژیک یا الگوهای…

۱۴ دقیقه خواندن۱
پژوهشگر سابق OpenAI: ۱۰۰ میلیارد دلار به داده آموزشی سرازیر می‌شود، چون مقیاس‌دهی به تنهایی کافی نیست

سرمایه‌گذاری ۱۰۰ میلیارد دلاری در داده‌های هدفمند؛ تنها راه نجات مدل‌های زبانی

اندرو هو، پژوهشگر سابق OpenAI، معتقد است مقیاس‌پذیری مدل‌ها دیگر کافی نیست و صنعت باید ۱۰۰ میلیارد دلار روی داده‌های باکیفیت و زمینه‌ای سرمایه‌گذاری کند. او هشدار می‌دهد که…

۳ دقیقه خواندن
گرداننده، برنامه‌ریز، شش متخصص: خط لوله چندعاملی که در محیط عملیاتی دوام آورد

سامانهٔ چندعاملی GenePattern تولید ماژول‌های بیوانفورماتیک را ۵۰۰٪ افزایش داد

یک مهندس نرم‌افزار با طراحی خط‌لولهٔ عامل‌محور و پیاده‌سازی سیستم‌های تأیید قطعی، سرعت تولید ابزار در GenePattern را ۵ برابر کرد. این دستاورد ثابت می‌کند که ساختار مهندسی پیرامون…

۱۴ دقیقه خواندن۱
مرز قیمت-عملکرد را با GPT-5.6 پیش می‌بریم

«تسهیل استقرار عامل‌های صنعتی»؛ هدف OpenAI از ارزان‌سازی مدل‌های Luna و Terra

شرکت OpenAI قیمت مدل‌های GPT-5.6 Luna و Terra را به‌شدت کاهش داد تا استقرار عامل‌های هوش مصنوعی در مقیاس صنعتی به‌صرفه شود. این تغییرات، به‌ویژه در مدل Luna، هزینه‌های عملیاتی…

۵ دقیقه خواندن۲
بررسی GPU مورد نیاز برای بازبینی کد محلی در ۲۰۲۶
آموزش کاربردی

سقف ۸ گیگابایت VRAM؛ نقطهٔ بهینه برای اجرای محلیِ بازبینی کد

برخلاف باور رایج، برای بازبینی کد با هوش مصنوعی نیازی به سخت‌افزارهای گران‌قیمت نیست و ۸ گیگابایت حافظه ویدیویی توازن ایده‌آلی میان هزینه و عملکرد ایجاد می‌کند. جهش از مدل‌های ۱.۵…

۶ دقیقه خواندن
ربات هوشمند جمینی ۲ با کنترل کل بدن، حرکات انسان‌وار انجام می‌دهد.

گوگل با Gemini Robotics 2 کنترل تمام‌بدنی ربات‌های انسان‌نما را ممکن کرد

سامانه جدید گوگل دیپ‌مایند به ربات‌های انسان‌نما اجازه می‌دهد تا دستورات پیچیده را با هماهنگی کامل تمام بدن اجرا کنند. این به‌روزرسانی علاوه بر افزایش مهارت در کارهای ظریف، امکان…

۶ دقیقه خواندن۲