
ارزیابی فنی: مدلهای کوچک تنظیمشده ۲۰ برابر سریعتر از APIها هستند
یک ارزیابی فنی نشان میدهد که مدلهای کوچکِ تنظیمشده (Fine-tuned) در وظایف مبتنی بر واژگان، بسیار دقیقتر و تا ۲۰ برابر سریعتر از APIهای پیشرفته عمل میکنند. این یافته ثابت…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۸۲ مقاله منتشر شده

یک ارزیابی فنی نشان میدهد که مدلهای کوچکِ تنظیمشده (Fine-tuned) در وظایف مبتنی بر واژگان، بسیار دقیقتر و تا ۲۰ برابر سریعتر از APIهای پیشرفته عمل میکنند. این یافته ثابت…

دسترسیهای Read-only برای مقابله با عاملهای هوش مصنوعی کافی نیستند، زیرا پرسوجوهای سنگین میتوانند منابع سیستم را بهطور کامل مصرف کنند. پیادهسازی محدودیتهای زمانی، سقف تعداد…

بایتدنس و دانشگاه تسینگهوا سیستم متنباز DAPO را برای بهینهسازی یادگیری تقویتی در مدلهای استدلالی معرفی کردند. این سیستم در محک AIME 2024، عملکرد مدل DeepSeek-R1-Zero را با…

پژوهشگران با استفاده از هوش مصنوعی از تحلیل تکنشانگرهای زیستی فاصله گرفته و به بررسی کل شبکههای تنظیمکننده بدن روی آوردهاند. این رویکرد با ترکیب دادههای اپیژنتیک و لنگرهای…

دستیارهای هوش مصنوعی تستهایی میسازند که درصد پوشش کد را بالا میبرند اما بررسیهای معنایی دقیقی انجام نمیدهند. این وضعیت باعث ایجاد حس امنیت کاذب در توسعهدهندگان شده و باگهای…

چارچوب جدید «کارتهای اعتماد» با تثبیت ساعت ارزیابی و تستهای خصمانه، از حملات بازپخش و مسمومسازی ابزار در سامانههای چندعاملی جلوگیری میکند. این رویکرد اجازه میدهد حالتهای…

یک چارچوب جدید برای «بستههای حافظه مهرومومشده» ریسک دستکاری وضعیت دادهها هنگام انتقال بین عاملهای AI را کاهش میدهد. این رویکرد با تثبیت ساعتهای ارزیابی و استفاده از دفاتر…

سامانه AX با معرفی یک لایه کنترل deklarative، مشکل هزینه و تأخیر در مدیریت ناوگانهای عظیم عاملهای هوش مصنوعی را حل کرده است. این پلتفرم با قابلیت تعلیق و بازیابی در کمتر از یک…

پژوهشی جدید نشان میدهد اکثریت شرکتها از «عاملهای سایه» استفاده میکنند که بدون نظارت امنیتی فعال هستند. این شکاف حاکمیتی، صنعت را به سمت پذیرش AgentOps سوق میدهد تا دسترسیهای…

گزارشهای جدید حاکی از آن است که غولهای هوش مصنوعی با بزرگنمایی خطرات «عاملهای سرکش»، به دنبال دریافت معافیتهای ضد انحصار از دولت آمریکا هستند. این استراتژی با هدف مسدود کردن…

یک معماری جدید با تلفیق بردارهای معنایی و گرافهای دانش، احتمال توهم در سیستمهای نظارتی مالی را به صفر رسانده است. این رویکرد هیبریدی، دقت ریاضی را جایگزین حدسهای احتمالی…

شرکت دیپسیک در ۱۰ سپتامبر ۲۰۲۶ مدل V4.1-Flash را معرفی کرد که علیرغم اندازه کوچکتر، عملکرد مدل پرچمدار V4-Pro را شکست میدهد. این تغییر نشاندهنده چرخش صنعت از مدلهای غولپیکر…