پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۸۷ مقاله منتشر شده

کتابی که یادگیری ماشین را متوقف کرد: داستان پرسپترون و جدایی‌پذیری خطی.

کتاب «پرسپترون‌ها» هرگز مرگ شبکه‌های عصبی را اثبات نکرد

بررسی مجدد تاریخچه هوش مصنوعی نشان می‌دهد کتاب سال ۱۹۶۹ مینسکی و پاپرت، محدودیت‌های سیستم‌های تک‌لایه را برجسته کرد، نه غیرممکن بودن شبکه‌های چندلایه را. زمستان هوش مصنوعی بیشتر…

۷ دقیقه خواندن۲
صفحه مدل زبانی کیوئن ۳.۸-۲.۴T-A95B در پلتفرم هاگینگ‌فیس

علی‌بابا: ۲.۴ تریلیون پارامتر برای اجرای وظایف عامل‌محور در Qwen3.8

تیم Qwen علی‌بابا مدل Qwen3.8 را با معماری MoE و ۲.۴ تریلیون پارامتر برای وظایف پیچیده و عامل‌محور منتشر کرد. این مدل با هدف ارتقای توانایی‌های کدنویسی و پژوهش‌های تخصصی،…

۸ دقیقه خواندن۳
مردی در حال صحبت کردن با گوشی هوشمند، با حالت ناامیدی و سردرگمی.

گفتار در برابر تایپ؛ افت شدید کیفیت LLM در وظایف پیچیده

پژوهشی جدید نشان می‌دهد لایه‌های «پاک‌سازی» متن در مسیر تبدیل گفتار به نوشتار، با حذف جزئیات ساختاری، عملکرد مدل‌های هوش مصنوعی را به‌شدت تخریب می‌کنند. این افت کیفیت در وظایف…

۸ دقیقه خواندن۴
تصویر: نمودار مقایسه توانایی‌های ریاضیاتی مدل‌های زبانی بزرگ در مسائل مختلف

مثال‌های نقض در برابر اثبات‌های مفهومی در مدل‌های زبانی

تحلیل پیشرفت‌های اخیر OpenAI نشان می‌دهد مدل‌های زبانی برای یافتن مثال‌های نقض و اثبات‌های وجودی از طریق آزمون و خطای سریع بهینه شده‌اند. این مدل‌ها به‌جای استدلال مفهومی عمیق، بر…

۲۵ دقیقه خواندن
بهینه‌سازی فراتر از روش تاگوچی: پیشروی ارزیابی مجازی از رامن (نسخه یکپارچه)
آموزش کاربردی

بهینه‌سازی با هوش مصنوعی هزینه ساخت نمونه‌های اولیه را ۹۹٪ کاهش داد

یک چارچوب جدید با جایگزینی روش‌های سنتی تاگوچی با بهینه‌سازی مبتنی بر مدل‌های زبانی، هزینه آزمایشات صنعتی را از ۸۰۰ هزار ین به ۳ هزار ین رساند. این متد با تبدیل طراحی محصول به یک…

۹ دقیقه خواندن۲
جلسه‌ای از مدل‌های ۲۷ میلیارد پارامتری، غول ۱.۶ تریلیونی را با هزینه‌ای کمتر شکست دادند
آموزش کاربردی

کمیته مدل‌های بازمتن در برابر مدل‌های تک‌سازه غول‌پیکر در مهندسی

چارچوب جدید Fusion-MOA با ایجاد یک «کمیته فنی» از مدل‌های کوچک و بازمتن، در وظایف مهندسی پیچیده از مدل‌های غول‌پیکر ابری پیشی گرفت. این رویکرد ثابت می‌کند سازمان‌دهی هوشمند مدل‌ها…

۱۰ دقیقه خواندن۱
اهمیت امنیت استدلال عمیق در سیستم‌های هوش مصنوعی
آموزش کاربردی

عامل‌های استدلالی چگونه دقت بازرسی امنیتی کدهای پایتون را بالا می‌برند؟

یک عامل امنیتی جدید با استفاده از ساختار دو مرحله‌ای «پوسته-عمق»، کدهای پایتون را بازرسی می‌کند. این سیستم با اجبار مدل دوم به نقد یافته‌های مدل اول، آسیب‌پذیری‌های پیچیده را…

۴ دقیقه خواندن
آنتروپیک Claude Sonnet 5 را برای اجرای ارزان‌تر عوامل هوش مصنوعی عرضه کرد

آیا سامانه چندعاملی آنتروپیک گرهی از فرضیه ریمان گشود

یک مدل آزمایشی از شرکت آنتروپیک با استفاده از یک سامانه چندعاملی، موفق شد کران پایین راهکارهای فرضیه ریمان را افزایش دهد. این دستاورد حاصل بررسی ۶۵۰ ایده مختلف طی ۳۶ ساعت محاسبات…

۳ دقیقه خواندن۵
نمودار: راهکارهای برتر برای استقرار سیستم‌های استدلال عمیق
آموزش کاربردی

مدل‌های استدلالی با قیمت‌گذاری درخواستی Oxlo.ai از تورم توکن‌ها رها شدند

استقرار مدل‌های استدلالی عمیق به‌دلیل گسترش توکن‌ها در زنجیره تفکر، هزینه‌های غیرقابل‌پیش‌بینی ایجاد می‌کند. Oxlo.ai با جایگزینی صورت‌حساب توکن‌محور با هزینه ثابت به‌ازای هر…

۶ دقیقه خواندن۱