پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۸۸ مقاله منتشر شده

مدل تقطیرشده چه چیزی از معلم خود به ارث می‌برد

«جداسازی استدلال از ایدئولوژی»؛ دستاورد جدید در تقطیر مدل‌های زبانی

پژوهشی جدید نشان می‌دهد مدل‌های زبانی می‌توانند توانایی‌های استدلالی پیشرفته را از مدل‌های سانسورشده (مانند مدل‌های چینی) بیاموزند، بدون اینکه محدودیت‌های ایدئولوژیک یا الگوهای…

۱۴ دقیقه خواندن۲
پژوهشگر سابق OpenAI: ۱۰۰ میلیارد دلار به داده آموزشی سرازیر می‌شود، چون مقیاس‌دهی به تنهایی کافی نیست

سرمایه‌گذاری ۱۰۰ میلیارد دلاری در داده‌های هدفمند؛ تنها راه نجات مدل‌های زبانی

اندرو هو، پژوهشگر سابق OpenAI، معتقد است مقیاس‌پذیری مدل‌ها دیگر کافی نیست و صنعت باید ۱۰۰ میلیارد دلار روی داده‌های باکیفیت و زمینه‌ای سرمایه‌گذاری کند. او هشدار می‌دهد که…

۳ دقیقه خواندن۱
گرداننده، برنامه‌ریز، شش متخصص: خط لوله چندعاملی که در محیط عملیاتی دوام آورد

سامانهٔ چندعاملی GenePattern تولید ماژول‌های بیوانفورماتیک را ۵۰۰٪ افزایش داد

یک مهندس نرم‌افزار با طراحی خط‌لولهٔ عامل‌محور و پیاده‌سازی سیستم‌های تأیید قطعی، سرعت تولید ابزار در GenePattern را ۵ برابر کرد. این دستاورد ثابت می‌کند که ساختار مهندسی پیرامون…

۱۴ دقیقه خواندن۱
مرز قیمت-عملکرد را با GPT-5.6 پیش می‌بریم

«تسهیل استقرار عامل‌های صنعتی»؛ هدف OpenAI از ارزان‌سازی مدل‌های Luna و Terra

شرکت OpenAI قیمت مدل‌های GPT-5.6 Luna و Terra را به‌شدت کاهش داد تا استقرار عامل‌های هوش مصنوعی در مقیاس صنعتی به‌صرفه شود. این تغییرات، به‌ویژه در مدل Luna، هزینه‌های عملیاتی…

۵ دقیقه خواندن۵
بررسی GPU مورد نیاز برای بازبینی کد محلی در ۲۰۲۶
آموزش کاربردی

سقف ۸ گیگابایت VRAM؛ نقطهٔ بهینه برای اجرای محلیِ بازبینی کد

برخلاف باور رایج، برای بازبینی کد با هوش مصنوعی نیازی به سخت‌افزارهای گران‌قیمت نیست و ۸ گیگابایت حافظه ویدیویی توازن ایده‌آلی میان هزینه و عملکرد ایجاد می‌کند. جهش از مدل‌های ۱.۵…

۶ دقیقه خواندن۱
ربات هوشمند جمینی ۲ با کنترل کل بدن، حرکات انسان‌وار انجام می‌دهد.

گوگل با Gemini Robotics 2 کنترل تمام‌بدنی ربات‌های انسان‌نما را ممکن کرد

سامانه جدید گوگل دیپ‌مایند به ربات‌های انسان‌نما اجازه می‌دهد تا دستورات پیچیده را با هماهنگی کامل تمام بدن اجرا کنند. این به‌روزرسانی علاوه بر افزایش مهارت در کارهای ظریف، امکان…

۶ دقیقه خواندن۳
مدل‌های زبانی نمی‌توانند انقلاب‌های علمی ایجاد کنند، اما مدل‌های جهانی شاید بتوانند.

ناکامی مدل‌های زبانی در ابداع نظریات علمی به‌دلیل نبود مدل‌های جهانی

پژوهش‌های جدید نشان می‌دهد مدل‌های زبانی به‌دلیل فقدان «استنتاج ابداعی»، قادر به خلق چارچوب‌های نظری جدید نیستند. تنها مدل‌های جهانی (World Models) که بر پایه تجربه فیزیکی بنا…

۴ دقیقه خواندن۲
نقص بنیادین مدل‌های زبانی بزرگ را به‌شدت در برابر حمله آسیب‌پذیر کرده است

جعل زنجیره تفکر؛ حفره‌ای ساختاری در مدل‌های OpenAI و Anthropic

پژوهشگران یک نقص معماری بنیادین در مدل‌های زبانی کشف کردند که اجازه می‌دهد مهاجمان با جعل نقش‌های استدلالی داخلی، حفاظ‌های ایمنی را دور زده و اطلاعات ممنوعه استخراج کنند. این…

۷ دقیقه خواندن۴