
LuisCore: جایگزینی اعداد ثابت با باندهای درصدی در ارزشگذاری
پلتفرم LuisCore روشی شفاف برای ارزشگذاری پروژه خود معرفی کرد که بهجای یک عدد ثابت، از باندهای درصدی و دادههای فنی زنده استفاده میکند. این سیستم تلاش میکند تا روایتهای مبهم…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۸۴ مقاله منتشر شده

پلتفرم LuisCore روشی شفاف برای ارزشگذاری پروژه خود معرفی کرد که بهجای یک عدد ثابت، از باندهای درصدی و دادههای فنی زنده استفاده میکند. این سیستم تلاش میکند تا روایتهای مبهم…

پلتفرم Oxlo.ai با جایگزینی مدل پرداخت توکنی با هزینه ثابت بهازای هر درخواست، مانع اقتصادی تحلیل فایلهای لاگ حجیم را از بین برد. این رویکرد امکان استدلال عمیق روی دادههای…

خودمختاری بدون محدودیت در عاملهای هوش مصنوعی منجر به شکستهای «اجرای جزئی» میشود که در آن تغییرات سیستمی بهصورت ناقص و غیرقابلبازگشت اعمال میشوند. قابلیت توقف دقیق و…

مدلهای زبانی مدرن بین دو مسیر معماری متراکم و ترکیب خبرهها (MoE) تقسیم شدهاند. در حالی که مدلهای متراکم از تمام توان خود برای هر پاسخ استفاده میکنند، MoE تنها بخشهای تخصصی…

قرارداد قابلیت عامل (ACC) لایهای قابلحمل برای تعریف حاکمیت کسبوکار در عاملهای هوش مصنوعی معرفی میکند. این استاندارد با تفکیک آنچه یک عامل میتواند ببیند از آنچه مجاز به…

شرکت OpenAI ارتباطات بین عاملهای هوش مصنوعی در ابزار Codex را رمزگذاری کرد تا توسعهدهندگان نتوانند روند تفویض تکالیف را ببینند. گمان میرود این اقدام برای جلوگیری از استخراج…

گوگل کتابخانه LiteRT.js را برای اجرای مدلهای .tflite مستقیماً در مرورگر از طریق WebGPU عرضه کرد. این ابزار با حذف هزینههای سروری و کاهش تأخیر، استنتاج بومی و بهینه شده را به وب…

یک چارچوب فنی جدید، نقشه راه کنترل هوش مصنوعی گوگل دیپمایند را به پنج آزمون امنیتی تکرارپذیر برای عاملهای کدنویسی تبدیل کرده است. این رویکرد تمرکز را از همراستاسازی مدل به تعیین…

ارزیابی عاملهای هوش مصنوعی بر اساس دموهای تبلیغاتی، منجر به تصمیمات نادرست میشود. یک تست ساختاریافته با سه سناریوی مشخص، توانایی عامل در مدیریت رگرسیونها و مرزهای تصمیمگیری…

گزارش جدید OpenAI نشان میدهد بسیاری از جدولهای رتبهبندی کدنویسی بهدلیل تداخل دادههای آموزشی و آزمون غیرقابلاعتماد هستند. این تحلیل تأکید میکند که نمرات بدون بررسی دقیق نشت…

یک الگوی ادغام جدید برای Claude Sonnet 5 بر استفاده از آداپتورهای تأمینکننده بهجای کدنویسی مستقیمِ وابسته به فروشنده تأکید میکند. این رویکرد با جداسازی فرمت مدل از منطق اصلی…

مدلهای صوتی OpenAI در نمایش «حق تقدمِ گفتگو» مشکل دارند و کاربر نمیداند چه کسی سخن میگوید یا گوش میدهد. برای حل این چالش، یک مدل رابط کاربری مبتنی بر «ماشین حالت» پیشنهاد شده…