پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۸۷ مقاله منتشر شده

هوش مصنوعی در رعایت آیین‌نامه کارمندان ناتوان است

شکست ۶۳.۸ درصدی مدل‌های پیشرو در اجرای سیاست‌های سازمانی

پژوهشی جدید نشان می‌دهد عامل‌های هوش مصنوعی حتی با دسترسی به دستورالعمل‌های شرکت، اغلب قوانین را نادیده گرفته و اقدامات ممنوعه انجام می‌دهند. این مطالعه اثبات می‌کند که پنجره‌های…

۸ دقیقه خواندن۳
نمونه‌ای از دستورالعمل‌های چندمرحله‌ای در سند HANDBOOK.md که نیازمند پیروی طولانی‌مدت عامل هوشمند است.

نرخ شکست ۶۳.۸ درصدی عامل‌های پیشرو در اجرای سیاست‌های سازمانی

یک محک جدید نشان می‌دهد که حتی پیشرفته‌ترین عامل‌های هوش مصنوعی در پیروی از دستورالعمل‌های پیچیده و بلندمدت شکست می‌خورند. این مدل‌ها اغلب در مواجهه با درخواست‌های محیطی، قوانین…

۲ دقیقه خواندن۲
مسیریابی هوشمند پرس‌وجو در دستیارهای SQL هوش مصنوعی: کاهش هزینه بدون افت کیفیت
آموزش کاربردی

Devart: مسیریابی چندلایه ۴۰ تا ۷۰ درصد در هزینه‌های AI صرفه‌جویی می‌کند

شرکت Devart با پیاده‌سازی یک سامانه مسیریابی چندلایه برای دستیار AI خود، از مصرف مدل‌های گران‌قیمت برای کارهای ساده SQL جلوگیری کرد. این رویکرد باعث کاهش هزینه‌های پردازشی تا ۷۰…

۸ دقیقه خواندن۲
مقایسه ابزار هوش مصنوعی و مدل: مبتدی‌ها کدام را بخرند؟
آموزش کاربردی

«هارنس پیش از اشتراک»؛ اولویت‌بندی ساختار عملیاتی بر ارتقای مدل

به جای ارتقای اشتراک مدل‌های هوش مصنوعی، ابتدا باید یک «هارنس» یا چهارچوب عملیاتی محکم بسازید. داده‌ها نشان می‌دهند اکثر شکست‌های کاربران ناشی از نبود فرآیند است، نه محدودیت‌های…

۷ دقیقه خواندن
کشف آسیب‌پذیری‌های رمزنگاری با Claude

کلاود میتوس؛ شناسایی نقاط ضعف ریاضی در الگوریتم‌های رمزنگاری پساکوانتومی

پژوهشگران آنتروپیک با استفاده از مدل Claude Mythos Preview توانستند نقص‌های ریاضی بنیادین در الگوریتم‌های رمزنگاری، از جمله طرح HAWK را کشف کنند. این دستاورد نشان‌دهنده انتقال هوش…

۱۶ دقیقه خواندن۲
شما هم می‌توانستید به «توجه دلتا کیمی» برسید | دابل‌ورد
آموزش کاربردی

معماری KDA: حذف تداخل حافظه با قانون دلتا در توالی‌های بلند

معماری جدید KDA با جایگزینی به‌روزرسانی‌های جمعی ساده با قانون دلتا و فراموشی کانال‌به‌کانال، مشکل تداخل در حافظه‌های با اندازه ثابت را برطرف می‌کند. این رویکرد به مدل‌ها اجازه…

۱۵ دقیقه خواندن۳
شناسایی کلید API سخت‌کد شده با روش اجماع چند مدل زبانی بزرگ که یک متخصص ارشد از دست داده بود
آموزش کاربردیتأییدنشده · منبع منفرد

۹۱ حفره امنیتی در ۱۲ ثانیه؛ NexaVerify متخصصان انسانی را شکست داد

سامانه NexaVerify با استفاده از اجماع چندمدلی، ۹۱ آسیب‌پذیری امنیتی را در ۱۲ ثانیه شناسایی کرد. این ابزار موفق شد یک کلید API حساس را در فایل‌های مستنداتی بیابد که یک متخصص ارشد…

۲ دقیقه خواندن۲