پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۶۹ مقاله منتشر شده

تولید داده آموزشی برای عامل‌های هوشمند سازمانی با AutoSynthData
آموزش کاربردی

AutoSynthData: تبدیل شکست‌های عامل‌های هوش مصنوعی به داده‌های آموزشی

سرویس‌نو (ServiceNow) سیستمی را معرفی کرد که نقاط ضعف عامل‌های هوش مصنوعی در محیط‌های سازمانی را شناسایی و به‌طور خودکار به داده‌های آموزشی تبدیل می‌کند. این رویکرد با استفاده از…

۱۰ دقیقه خواندن
بررسی ۱۲۳ نفر در هند برای ارزیابی هوش مصنوعی پیشرفته

مدل‌های استدلالی با نرخ ۴۱٪ در برابر سوگیری‌های جمعیتی شکست خوردند

یک محک جدید بر اساس مناقشات واقعی در هند نشان می‌دهد مدل‌های «متفکر» بیش از مدل‌های دستوری معمولی مستعد سوگیری جمعیتی هستند. توکن‌های استدلالی به‌جای ارتقای انصاف، اغلب به ابزاری…

۴ دقیقه خواندن۱
شبیه‌سازی مولد برای زنجیره تأمین تولید دایره‌ای با قابلیت حسابرسی اخلاقی
آموزش کاربردی

لایهٔ حسابرسی رمزنگاری‌شده مصرف مواد اولیه در تولید چرخشی را ۳۴٪ کاهش داد

یک معماری جدید هوش مصنوعی با ترکیب مدل‌های انتشار و سیاست‌های عامل‌محور، اتلاف منابع در زنجیره تأمین را به شدت کاهش می‌دهد. این سیستم با افزودن یک لایه حسابرسی رمزنگاری‌شده، از…

۱۰ دقیقه خواندن۲
نقاشی دست‌نویس قدیمی از دودو، پرنده منقرض‌شده موریس، در کتابی از سده هفدهم.
آموزش کاربردی

«کارآگاهان دیجیتال»؛ نقش جدید Agentها در پر کردن شکاف‌های تاریخی

یک پژوهشگر با استفاده از Opus 5.5 میلیون‌ها سند شرکت هند شرقی هلند را بررسی کرد و به لاگ کشتی سال ۱۶۱۵ دست یافت که شکار پرنده منقرض‌شده‌ی دودو را ثبت کرده است. این یافته نشان…

۱۰ دقیقه خواندن
باور داشتیم عامل GPT-5.4‌مان در محصول تنبل‌تر شده؛ یک جریان کاری سه‌باگی بود که ترک کار را آموخته بود.
آموزش کاربردی

«تنبلی مدل»؛ پیامد مستقیم معیارهای موفقیت سطحی در محیط استقرار

یک کالبدشکافی فنی نشان می‌دهد «تنبلی مدل» در محیط تولید معمولاً نتیجه‌ی باگ‌های لایه‌ی ارکستراسیون است، نه افت کیفیت مدل. محدودیت‌های سخت‌گیرانه در تلاش مجدد و معیارهای موفقیت…

۹ دقیقه خواندن
مقاله «عصر هوشمندی» اوپن‌ای‌آی: «مکمل ابدی»

ارزش ابرهوش در انجام کارهای کسالت‌بار؛ دیدگاه تازه OpenAI درباره اقتصاد AGI

تیم آینده‌های استراتژیک OpenAI در پلتفرم جدید خود استدلال می‌کند که با ارزان شدن «نابغه بودن» مدل‌ها، گلوگاه پیشرفت بشری از ایده‌پردازی به اجرای فیزیکی و کسالت‌بار تغییر می‌کند.

۵ دقیقه خواندن
انتشار BootLoops ۱.۰: ابزار متن‌باز تسخیر مدل‌های زبانی بزرگ برای علم توسط اشنارتس

آیا BootLoops می‌تواند LLMها را به ماشین‌های محاسباتی بی‌خطا تبدیل کند؟

متیو شوارتز ابزار متن‌باز BootLoops 1.0 را برای تبدیل LLMها به ماشین‌های محاسباتی با دقت بالا معرفی کرد. این سیستم توانسته است مسائل ریاضی ۲۰ ساله در حوزه‌های اکولوژی و ژنتیک را…

۶ دقیقه خواندن
مدل‌های کوچک‌تر URLها را مثل پایتون می‌خوانند، نه مثل fetch(). تست کردم کجا کلید API لو می‌رود.

منطق پایتون در برابر استانداردهای مرورگر در تحلیل URLهای هوش مصنوعی

یک محک امنیتی جدید نشان می‌دهد مدل‌های کوچک هوش مصنوعی به‌جای استاندارد مرورگرها، از منطق پایتون برای تحلیل URLها استفاده می‌کنند. این تضاد فنی به مهاجمان اجازه می‌دهد با دور زدن…

۱۱ دقیقه خواندن
شبکه عصبی: یادگیری الگوها از داده‌ها

۳ مرحلهٔ ریاضی برای تبدیل داده‌های خام به یادگیری عمیق

شبکه‌های عصبی با شبیه‌سازی ساختار نورون‌های بیولوژیک، الگوهای پیچیده در داده‌ها را شناسایی می‌کنند. این راهنما چرخه ریاضی پیش‌بینی، اندازه‌گیری خطا و تنظیم وزن‌ها را که هسته اصلی…

۱۴ دقیقه خواندن