پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۸۱ مقاله منتشر شده

گزارش پژوهشی با استناددهی در پایتون با Evidence Graph Studio
آموزش کاربردی

Evidence Graph Studio: تبدیل پژوهش‌های هوش مصنوعی به گزارش‌های قابل‌راستی‌آزمایی

ابزار Evidence Graph Studio با استفاده از یک پرونده JSON، ادعاهای پژوهشی را به منابع دقیق متصل می‌کند. این ابزار به محققان اجازه می‌دهد تا صحت استنادها را به‌صورت خودکار بررسی…

۶ دقیقه خواندن۲
آموزش پسا Tulu 3 با SFT، DPO، RLVR، GRPO و ارزیابی مبتنی بر تأییدکننده
آموزش کاربردی

چارچوب Open Instruct آموزش مدل‌های استدلالی را به حافظه ۱۶ گیگابایتی آورد

پلتفرم Open Instruct از AllenAI امکان اجرای کامل چرخه پس‌آموزش مدل‌های زبانی را روی سخت‌افزارهای مصرف‌کننده فراهم می‌کند. این سیستم با جایگزینی اجزای توزیع‌شده با پیاده‌سازی‌های…

۱۲ دقیقه خواندن۲
کتابی که یادگیری ماشین را متوقف کرد: داستان پرسپترون و جدایی‌پذیری خطی.

کتاب «پرسپترون‌ها» هرگز مرگ شبکه‌های عصبی را اثبات نکرد

بررسی مجدد تاریخچه هوش مصنوعی نشان می‌دهد کتاب سال ۱۹۶۹ مینسکی و پاپرت، محدودیت‌های سیستم‌های تک‌لایه را برجسته کرد، نه غیرممکن بودن شبکه‌های چندلایه را. زمستان هوش مصنوعی بیشتر…

۷ دقیقه خواندن۲
صفحه مدل زبانی کیوئن ۳.۸-۲.۴T-A95B در پلتفرم هاگینگ‌فیس

علی‌بابا: ۲.۴ تریلیون پارامتر برای اجرای وظایف عامل‌محور در Qwen3.8

تیم Qwen علی‌بابا مدل Qwen3.8 را با معماری MoE و ۲.۴ تریلیون پارامتر برای وظایف پیچیده و عامل‌محور منتشر کرد. این مدل با هدف ارتقای توانایی‌های کدنویسی و پژوهش‌های تخصصی،…

۸ دقیقه خواندن۲
مردی در حال صحبت کردن با گوشی هوشمند، با حالت ناامیدی و سردرگمی.

گفتار در برابر تایپ؛ افت شدید کیفیت LLM در وظایف پیچیده

پژوهشی جدید نشان می‌دهد لایه‌های «پاک‌سازی» متن در مسیر تبدیل گفتار به نوشتار، با حذف جزئیات ساختاری، عملکرد مدل‌های هوش مصنوعی را به‌شدت تخریب می‌کنند. این افت کیفیت در وظایف…

۸ دقیقه خواندن۳
تصویر: نمودار مقایسه توانایی‌های ریاضیاتی مدل‌های زبانی بزرگ در مسائل مختلف

مثال‌های نقض در برابر اثبات‌های مفهومی در مدل‌های زبانی

تحلیل پیشرفت‌های اخیر OpenAI نشان می‌دهد مدل‌های زبانی برای یافتن مثال‌های نقض و اثبات‌های وجودی از طریق آزمون و خطای سریع بهینه شده‌اند. این مدل‌ها به‌جای استدلال مفهومی عمیق، بر…

۲۵ دقیقه خواندن
بهینه‌سازی فراتر از روش تاگوچی: پیشروی ارزیابی مجازی از رامن (نسخه یکپارچه)
آموزش کاربردی

بهینه‌سازی با هوش مصنوعی هزینه ساخت نمونه‌های اولیه را ۹۹٪ کاهش داد

یک چارچوب جدید با جایگزینی روش‌های سنتی تاگوچی با بهینه‌سازی مبتنی بر مدل‌های زبانی، هزینه آزمایشات صنعتی را از ۸۰۰ هزار ین به ۳ هزار ین رساند. این متد با تبدیل طراحی محصول به یک…

۹ دقیقه خواندن۲
جلسه‌ای از مدل‌های ۲۷ میلیارد پارامتری، غول ۱.۶ تریلیونی را با هزینه‌ای کمتر شکست دادند
آموزش کاربردی

کمیته مدل‌های بازمتن در برابر مدل‌های تک‌سازه غول‌پیکر در مهندسی

چارچوب جدید Fusion-MOA با ایجاد یک «کمیته فنی» از مدل‌های کوچک و بازمتن، در وظایف مهندسی پیچیده از مدل‌های غول‌پیکر ابری پیشی گرفت. این رویکرد ثابت می‌کند سازمان‌دهی هوشمند مدل‌ها…

۱۰ دقیقه خواندن۱
اهمیت امنیت استدلال عمیق در سیستم‌های هوش مصنوعی
آموزش کاربردی

عامل‌های استدلالی چگونه دقت بازرسی امنیتی کدهای پایتون را بالا می‌برند؟

یک عامل امنیتی جدید با استفاده از ساختار دو مرحله‌ای «پوسته-عمق»، کدهای پایتون را بازرسی می‌کند. این سیستم با اجبار مدل دوم به نقد یافته‌های مدل اول، آسیب‌پذیری‌های پیچیده را…

۴ دقیقه خواندن