پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۰۹۸ مقاله منتشر شده

نمونه‌ای از دستورالعمل‌های چندمرحله‌ای در سند HANDBOOK.md که نیازمند پیروی طولانی‌مدت عامل هوشمند است.

نرخ شکست ۶۳.۸ درصدی عامل‌های پیشرو در اجرای سیاست‌های سازمانی

یک محک جدید نشان می‌دهد که حتی پیشرفته‌ترین عامل‌های هوش مصنوعی در پیروی از دستورالعمل‌های پیچیده و بلندمدت شکست می‌خورند. این مدل‌ها اغلب در مواجهه با درخواست‌های محیطی، قوانین…

۲ دقیقه خواندن۲
مسیریابی هوشمند پرس‌وجو در دستیارهای SQL هوش مصنوعی: کاهش هزینه بدون افت کیفیت
آموزش کاربردی

Devart: مسیریابی چندلایه ۴۰ تا ۷۰ درصد در هزینه‌های AI صرفه‌جویی می‌کند

شرکت Devart با پیاده‌سازی یک سامانه مسیریابی چندلایه برای دستیار AI خود، از مصرف مدل‌های گران‌قیمت برای کارهای ساده SQL جلوگیری کرد. این رویکرد باعث کاهش هزینه‌های پردازشی تا ۷۰…

۸ دقیقه خواندن۲
مقایسه ابزار هوش مصنوعی و مدل: مبتدی‌ها کدام را بخرند؟
آموزش کاربردی

«هارنس پیش از اشتراک»؛ اولویت‌بندی ساختار عملیاتی بر ارتقای مدل

به جای ارتقای اشتراک مدل‌های هوش مصنوعی، ابتدا باید یک «هارنس» یا چهارچوب عملیاتی محکم بسازید. داده‌ها نشان می‌دهند اکثر شکست‌های کاربران ناشی از نبود فرآیند است، نه محدودیت‌های…

۷ دقیقه خواندن
کشف آسیب‌پذیری‌های رمزنگاری با Claude

کلاود میتوس؛ شناسایی نقاط ضعف ریاضی در الگوریتم‌های رمزنگاری پساکوانتومی

پژوهشگران آنتروپیک با استفاده از مدل Claude Mythos Preview توانستند نقص‌های ریاضی بنیادین در الگوریتم‌های رمزنگاری، از جمله طرح HAWK را کشف کنند. این دستاورد نشان‌دهنده انتقال هوش…

۱۶ دقیقه خواندن
شما هم می‌توانستید به «توجه دلتا کیمی» برسید | دابل‌ورد
آموزش کاربردی

معماری KDA: حذف تداخل حافظه با قانون دلتا در توالی‌های بلند

معماری جدید KDA با جایگزینی به‌روزرسانی‌های جمعی ساده با قانون دلتا و فراموشی کانال‌به‌کانال، مشکل تداخل در حافظه‌های با اندازه ثابت را برطرف می‌کند. این رویکرد به مدل‌ها اجازه…

۱۵ دقیقه خواندن۲
شناسایی کلید API سخت‌کد شده با روش اجماع چند مدل زبانی بزرگ که یک متخصص ارشد از دست داده بود
آموزش کاربردیتأییدنشده · منبع منفرد

۹۱ حفره امنیتی در ۱۲ ثانیه؛ NexaVerify متخصصان انسانی را شکست داد

سامانه NexaVerify با استفاده از اجماع چندمدلی، ۹۱ آسیب‌پذیری امنیتی را در ۱۲ ثانیه شناسایی کرد. این ابزار موفق شد یک کلید API حساس را در فایل‌های مستنداتی بیابد که یک متخصص ارشد…

۲ دقیقه خواندن۱
نحوه مدل‌سازی ادعاهای علمی قبل از تولید نمودار
آموزش کاربردی

جایگزینی مشخصات فنی با پیکسل‌ها؛ راهکار جدید حذف توهم در دیاگرام‌های علمی

یک گردش‌کار جدید در تصویرسازی علمی، مدل‌های هوش مصنوعی را از تولید مستقیم تصویر به مدل «ابتدا مشخصات» منتقل کرده است. این سیستم با اجبار مدل به تعریف توپولوژی و شواهد پیش از…

۵ دقیقه خواندن۱