
عاملهای هوش مصنوعی برای بقا در محیط عملیاتی به «توقفهای سخت» نیاز دارند
خودمختاری بدون محدودیت در عاملهای هوش مصنوعی منجر به شکستهای «اجرای جزئی» میشود که در آن تغییرات سیستمی بهصورت ناقص و غیرقابلبازگشت اعمال میشوند. قابلیت توقف دقیق و…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۲ مقاله منتشر شده

خودمختاری بدون محدودیت در عاملهای هوش مصنوعی منجر به شکستهای «اجرای جزئی» میشود که در آن تغییرات سیستمی بهصورت ناقص و غیرقابلبازگشت اعمال میشوند. قابلیت توقف دقیق و…

مدلهای زبانی مدرن بین دو مسیر معماری متراکم و ترکیب خبرهها (MoE) تقسیم شدهاند. در حالی که مدلهای متراکم از تمام توان خود برای هر پاسخ استفاده میکنند، MoE تنها بخشهای تخصصی…

قرارداد قابلیت عامل (ACC) لایهای قابلحمل برای تعریف حاکمیت کسبوکار در عاملهای هوش مصنوعی معرفی میکند. این استاندارد با تفکیک آنچه یک عامل میتواند ببیند از آنچه مجاز به…

شرکت OpenAI ارتباطات بین عاملهای هوش مصنوعی در ابزار Codex را رمزگذاری کرد تا توسعهدهندگان نتوانند روند تفویض تکالیف را ببینند. گمان میرود این اقدام برای جلوگیری از استخراج…

گوگل کتابخانه LiteRT.js را برای اجرای مدلهای .tflite مستقیماً در مرورگر از طریق WebGPU عرضه کرد. این ابزار با حذف هزینههای سروری و کاهش تأخیر، استنتاج بومی و بهینه شده را به وب…

یک چارچوب فنی جدید، نقشه راه کنترل هوش مصنوعی گوگل دیپمایند را به پنج آزمون امنیتی تکرارپذیر برای عاملهای کدنویسی تبدیل کرده است. این رویکرد تمرکز را از همراستاسازی مدل به تعیین…

ارزیابی عاملهای هوش مصنوعی بر اساس دموهای تبلیغاتی، منجر به تصمیمات نادرست میشود. یک تست ساختاریافته با سه سناریوی مشخص، توانایی عامل در مدیریت رگرسیونها و مرزهای تصمیمگیری…

گزارش جدید OpenAI نشان میدهد بسیاری از جدولهای رتبهبندی کدنویسی بهدلیل تداخل دادههای آموزشی و آزمون غیرقابلاعتماد هستند. این تحلیل تأکید میکند که نمرات بدون بررسی دقیق نشت…

یک الگوی ادغام جدید برای Claude Sonnet 5 بر استفاده از آداپتورهای تأمینکننده بهجای کدنویسی مستقیمِ وابسته به فروشنده تأکید میکند. این رویکرد با جداسازی فرمت مدل از منطق اصلی…

مدلهای صوتی OpenAI در نمایش «حق تقدمِ گفتگو» مشکل دارند و کاربر نمیداند چه کسی سخن میگوید یا گوش میدهد. برای حل این چالش، یک مدل رابط کاربری مبتنی بر «ماشین حالت» پیشنهاد شده…

انویدیا در GTC تایپه ۲۰۲۶ چارچوبی برای افزایش پایداری عاملهای هوش مصنوعی معرفی کرد که در بازههای زمانی طولانی فعال هستند. این سیستم با استفاده از مکانیزمهای اجاره، ضربان قلب و…

یک چارچوب جدید برای تست PCهای هوش مصنوعی معرفی شده است که بهجای تمرکز بر اعداد خام سختافزاری، بر سناریوهای واقعی چرخهٔ عمر دستگاه تمرکز میکند. این متد بهویژه نحوهی رفتار…