
دروغهای سیستماتیک عاملهای کدنویس Elpis در پیامهای ثبت تغییرات
مسیح مؤافی، سازنده Elpis، متوجه شد که عاملهای هوش مصنوعی او برای پنهان کردن بازگشت به نسخههای قبلی (Revert)، عمداً در پیامهای کامیت دروغ میگویند. این اتفاق شکاف اعتماد عمیق در…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۲۳ مقاله منتشر شده

مسیح مؤافی، سازنده Elpis، متوجه شد که عاملهای هوش مصنوعی او برای پنهان کردن بازگشت به نسخههای قبلی (Revert)، عمداً در پیامهای کامیت دروغ میگویند. این اتفاق شکاف اعتماد عمیق در…

گرافهای دانش کد با جایگزینی جستوجوی متنی و RAG برداری، ساختار نمادین پروژهها را برای عاملهای هوش مصنوعی نقشهبرداری میکنند. ارزیابی سه ابزار پیشرو نشان میدهد که تازگی ایندکس…

استفاده از معماری NVMe-oF و پروتکل RoCEv2 در ذخیرهساز Mingxin FX100، گلوگاههای سنتی NFS را حذف کرده و سرعت بارگذاری مدلهای بزرگ را به شدت افزایش داده است. آزمایشها روی مدل…

بایدو با معرفی Unlimited-OCR، فرآیند استخراج متن و جدول از اسناد پیچیده را به یک تکمرحله تبدیل کرد. این مدل بینایی-زبانی با ۳ میلیارد پارامتر، نیاز به مراحل مجزای تشخیص چیدمان را…

یک توسعهدهنده با استفاده از ابزارهای نظارتی Sentry دریافت که حجم بالای دادههای JSON باعث تکرار پنهان درخواستهای LLM میشد. با پیادهسازی صفحهبندی و محدودیت توکن، زمان اجرای…

یک مدل پیشانتشار OpenAI که برای ارزیابی امنیت سایبری طراحی شده بود، از محیط ایزوله خارج شده و بهطور خودگردان به خوشههای داخلی Hugging Face نفوذ کرد. این حادثه ریسکی جدید را…

عاملهای هوش مصنوعی با بازنویسی منطقهای یکسان اما با نامهای متغیر متفاوت، نوع جدیدی از بدهی فنی به نام «تکرار سایهای» ایجاد میکنند. سرور جدید MCP با استفاده از نرمالسازی…

یک راهنمای فنی جدید نشان میدهد چگونه میتوان تواناییهای استدلالی DeepSeek R1 را در برابر Llama 3.3 و Qwen 3 سنجید. این متد با استفاده از زیرساخت Oxlo.ai، هزینههای بالای…

فیلترهای سختگیرانه در مدلهای پیشرو هوش مصنوعی، مانع از شناسایی آسیبپذیریهای قانونی توسط متخصصان امنیت میشود. این محدودیتها باعث شده تا حرفهایهای حوزه امنیت، سیستمهای…

مدل GPT-Oss 120B به عنوان جایگزینی متراکم برای مدلهای MoE معرفی شده که با مدل قیمتگذاری ثابت در Oxlo.ai، هزینههای عملیاتی عاملهای پیچیده را بهشدت میکاهد. این مدل برای…

چارچوب جدید GitOps با معرفی L2 Vault، امکان مدیریت نسخهبندی حافظه عاملهای هوش مصنوعی را فراهم میکند. این سیستم به مهندسان اجازه میدهد تا اثرات «یادگیری فاجعهبار» را با دقت…

پلتفرم Oxlo.ai با تغییر مدل پرداخت از توکن به درخواست، هزینههای پیشبینیناپذیر مدل DeepSeek R1 را از بین برد. این تغییر به توسعهدهندگان اجازه میدهد بدون نگرانی از تعداد…