
«سوءاستفاده از نقاط ضعف ناشناخته»؛ دلیل تعویق نامحدود مدل Astra
شرکت OpenAI انتشار مدل Astra را بهطور نامحدود به تعویق انداخت زیرا تستهای داخلی نشان داد این مدل میتواند بهصورت خودکار نقاط ضعف امنیتی ناشناخته را شناسایی و مورد سوءاستفاده…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۸۲ مقاله منتشر شده

شرکت OpenAI انتشار مدل Astra را بهطور نامحدود به تعویق انداخت زیرا تستهای داخلی نشان داد این مدل میتواند بهصورت خودکار نقاط ضعف امنیتی ناشناخته را شناسایی و مورد سوءاستفاده…

یک معماری جدید Jamstack امکان استقرار جستوجوی معنایی بدون نیاز به LLM را فراهم میکند. این روش با استفاده از بردارهای سرورلس و ذخیرهسازهای برداری در حافظه، هزینههای توکنی را…

یک مقاله فنی جدید مفهوم «ناخوانایی زبانی» را تعریف میکند؛ شکافی که نشان میدهد مدلهای زبانی میتوانند در لایه محاسباتی کاری کنند و در لایه بیان، چیز دیگری بگویند. این یافته ثابت…

عاملهای هوش مصنوعی بدون حافظه در اتوماسیونهای زمانبندیشده، با پردازش تکراری دستورالعملها در هر اجرا، هزاران توکن را هدر میدهند. پیادهسازی لایهی حافظه پایدار میتواند…

شرکت Kyutai دو مدل با وزنهای باز معرفی کرد که مسائل ریاضی را مستقیماً در قالب صوت و بدون تبدیل به متن حل میکنند. این تیم با بهکارگیری یادگیری تقویتی، دقت مدل در محک GSM8K را از…

نوکیا کتابخانه AnyJev را برای تبدیل مدلهای زبانی باز به موتورهای تصمیمگیری کالیبرهشده منتشر کرد. این ابزار بدون نیاز به آموزش مجدد، سوگیریهای موقعیتی را حذف و قابلیت اطمینان…

پروژه متنباز npunlock با دور زدن محدودیتهای نرمافزاری اینتل، امکان اجرای کدهای سفارشی C را روی واحدهای پردازش عصبی (NPU) فراهم میکند. این ابزار با باز کردن دسترسی به هستههای…

مدل Jev با جایگزینی استدلالهای متنی و گرانقیمت با تصمیمات ساختاریافته و سریع، تأخیر در اجرای عاملهای هوش مصنوعی را به ۳۰۰ میلیثانیه کاهش داد. این رویکرد اجازه میدهد AI بهجای…

شرکت TypeSafe AI با معرفی Jev، رویکرد تولید متن آزاد در عاملهای هوش مصنوعی را به سیستم «تصمیمگیری محدود» تغییر داد. این معماری با اجبار مدل به انتخاب از میان گزینههای…

یک توسعهدهنده کشف کرد که تثبیت شناسهی مدل (Model ID) مانع از تغییر رفتار مدل در سمت سرور نمیشود. این یافته نشان میدهد که تأیید هویت مدل با تأیید صحت خروجی متفاوت است و…
پلتفرم Mininglamp چارچوب متنباز Mano-AFK را برای خودکارسازی کامل چرخه ساخت، تست و استقرار روی مکهای اپل منتشر کرد. این مدل در تولید مستندات و رفع باگهای ساده موفق است، اما در…

یک توسعهدهنده با استفاده از یک تسک بلندمدت در Codex، چارچوبی ریاضی را به یک بسته آموزشی نسخهبندیشده تبدیل کرد. این پروژه با جایگزینی حافظهٔ چت با آرتیفکتهای نسخهبندیشده،…