پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۱۲ مقاله منتشر شده

پیش‌نمایش مدل نسل بعدی GPT-5.6 Sol: هوش مصنوعی پیشرفته با قابلیت‌های نوآورانه

مدل Sol در برابر Mythos؛ برتری در استدلال‌های عامل‌محور و امنیت

اوپن‌ای‌آی پیش‌نمایش محدودی از سری GPT-5.6 را منتشر کرد که مدل پرچمدار آن، Sol، با تمرکز بر استدلال‌های عامل‌محور و لایه‌های امنیتی شدید عرضه شده است. این عرضه به‌صورت مرحله‌ای و…

۸ دقیقه خواندن
آیا ماشین‌ها بیدارند؟ زنده در برابر محرک — و آن چیز واحدی که هوش مصنوعی فاقد آن است

سرمایه‌گذاری میلیارد دلاری ین لکون برای جایگزینی پیش‌بینی توکن با مدل‌های جهان

ین لکون با هدف عبور از محدودیت‌های مدل‌های زبانی، بیش از یک میلیارد دلار برای توسعه «مدل‌های جهان» هزینه می‌کند. منتقدان معتقدند بدون داشتن تکانه‌ی زیستی برای بقا، این سامانه‌ها…

۶ دقیقه خواندن
مسیر اتصال نامشخص: چالش تبدیل متن به SQL در پایگاه‌های داده پیچیده
آموزش کاربردی

شکاف بین کد صحیح و پاسخ درست؛ دلیل شکست Text-to-SQL در سازمان‌ها

صحت ساختاری یک کوئری SQL تضمین‌کننده‌ی دقت پاسخ‌های تجاری در محیط‌های سازمانی نیست. الگوی معماری جدید پیشنهاد می‌کند که برای جلوگیری از خطاهای گزارش‌دهی، به جای تکیه بر متادیتای…

۴ دقیقه خواندن
۵ تکنیک مهندسی پرامپت برای بهره‌برداری بهتر از پروژه قدیمی
آموزش کاربردی

۵ تکنیک مهندسی پرامپت برای بازسازی و رمزگشایی کدهای میراثی

یک راهنمای جامع پنج استراتژی مهندسی پرامپت را برای درک و عیب‌یابی پروژه‌های قدیمی و بدون مستندات معرفی کرده است. این روش‌ها با استفاده از محدودیت‌های ساختاری و فیلترهای نقش-محور،…

۵ دقیقه خواندن
DeepReinforce مدل کدنویسی متن‌باز Ornith-1.0 را منتشر کرد: خانواده‌ای از مدل‌هایی که داربست‌های یادگیری تقویتی خود را می‌آموز

مدل Ornith-1.0 استقرار عامل‌های کدنویسی را از مهندسی دستی به یادگیری خودکار برد

DeepReinforce خانواده مدل‌های بازمتن Ornith-1.0 را معرفی کرد که قادرند ساختارهای اجرایی (Scaffolds) خود را طی یادگیری تقویتی بهینه کنند. مدل پرچم‌دار ۳۹۷ میلیارد پارامتری این…

۴ دقیقه خواندن
تزریق پرامپت، سردرگمی نقش است و دروازه MCP شما نمی‌تواند آن را ببیند

جعل زنجیره‌های تفکر، نرخ موفقیت جیل‌بریک را به ۶۰٪ رساند

پژوهشگران دریافتند که تقلید از سبک تفکر داخلی مدل‌ها، مؤثرترین راه برای دور زدن حفاظ‌های امنیتی است. این آسیب‌پذیری به‌ویژه در درگاه‌های MCP که محتوای پاسخ ابزارها را بررسی…

۴ دقیقه خواندن
نمودار مقایسه دقت پیش‌بینی توکن‌ها در مدل ترکیبی نسبت به مدل‌های پایه

چرا مدل‌های ترکیبی Olmo در کپی‌برداری دقیق از ترنسفورمرها ضعیف‌ترند؟

پژوهشگران دریافتند که معماری‌های ترکیبی (Hybrid) در درک کلمات محتوایی و ردیابی وضعیت‌های پیچیده موفق‌تر هستند. با این حال، این مدل‌ها در کپی‌برداری دقیق و تطبیق ساختاری، همچنان…

۶ دقیقه خواندن
شرط ۲.۳ میلیارد دلاری جنرال اینتویشن: بازی‌های ویدیویی می‌توانند عامل‌های هوش مصنوعی را برای دنیای واقعی آموزش دهند.

درون معماری General Intuition؛ تبدیل میلیون‌ها ساعت گیم‌پلی به مهارت رباتیک

استارتاپ General Intuition برای آموزش استدلال فضایی ربات‌ها از میلیون‌ها ساعت داده‌های بازی‌های ویدئویی استفاده می‌کند. این شرکت با جذب ۳۲۰ میلیون دلار سرمایه، قصد دارد شکاف بین…

۸ دقیقه خواندن۲
پرطرفدارترین مقالات هوش مصنوعی در هاگینگ فیس - ۲۵ ژوئن ۲۰۲۶

۱۰ مقالهٔ برتر Hugging Face محوریت پژوهش AI را از چت‌بات به عامل‌های فعال تغییر

خوشه‌ای از مقالات پربازدید در Hugging Face نشان‌دهنده گذاری استراتژیک از مدل‌های پاسخ‌دهنده به عامل‌هایی است که قادر به مدل‌سازی جهان و اجرای عملیات در زمان واقعی هستند. این تحول…

۱۰ دقیقه خواندن۱