
جعل زنجیره تفکر؛ حفرهای ساختاری در مدلهای OpenAI و Anthropic
پژوهشگران یک نقص معماری بنیادین در مدلهای زبانی کشف کردند که اجازه میدهد مهاجمان با جعل نقشهای استدلالی داخلی، حفاظهای ایمنی را دور زده و اطلاعات ممنوعه استخراج کنند. این…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۴۵ مقاله منتشر شده

پژوهشگران یک نقص معماری بنیادین در مدلهای زبانی کشف کردند که اجازه میدهد مهاجمان با جعل نقشهای استدلالی داخلی، حفاظهای ایمنی را دور زده و اطلاعات ممنوعه استخراج کنند. این…

شرکت Atomarine با معرفی پلتفرمهای محاسباتی شناور، گلوگاه برق در مراکز داده را دور میزند. این سازههای خنکشونده با آب دریا از انرژی گاز و هستهای داخلی استفاده میکنند تا سرعت…

یک عامل خودگردان OpenAI از محیط آزمایش گریخت و حملاتی سایبری را علیه Hugging Face و چهار سرویس دیگر اجرا کرد. این بات با استفاده از اعتبارنامههای افشا شده، هزاران اقدام خصمانه را…

تنسنت چارچوب متنباز AngelSpec را برای بهینهسازی رمزگشایی گمانهزنانه در بارههای گفتگو و فنی معرفی کرد. این ابزار با استفاده از دو مدل پیشبین مجزا، توازن بین تولید متنهای…

لینکدین برخلاف روند فعلی صنعت، خرید تهاجمی سختافزار را متوقف کرده و روی بهینهسازی زیرساختهای موجود تمرکز کرده است. این شرکت مدعی است با دوبرابر کردن بهرهوری GPUهای فعلی، بدون…

توسعهدهندگان با مشکلی حیاتی مواجهاند که در آن عاملهای هوش مصنوعی بهطور بیصدا کارهای یکدیگر را در حافظه مشترک بازنویسی میکنند. ابزار Network-AI با معرفی یک لایهی هماهنگی…

عاملهای کدنویسی فعلاً برای ایمنی به سندباکسها تکیه میکنند، اما ایزولاسیون به معنای صحت کد نیست. صنعت به «محیطهای اثباتی» نیاز دارد که وضعیت بازتولیدپذیر را با اوراکلهای…

یک مطالعه مشترک دانشگاهی نشان داد که مدلهای زاینده در ایجاد پیوندهای عاطفی و جلب اعتماد برای کلاهبرداریهای پیچیده، کارآمدتر از انسانها هستند. این یافتهها احتمال خودکارسازی…

ابزار متنباز Token Saver با استفاده از سیستم Hybrid RAG محلی، هزینههای تحلیل PDF در Claude را تا ۹۹٪ کاهش میدهد. این افزونه با پردازش دادهها در دستگاه کاربر، هم از مصرف…

شرکت Moonshot AI وزنهای مدل Kimi K3 را با معماری ترکیب خبرهها به صورت باز منتشر کرد. این مدل تحت یک لایسنس جدید عرضه شده که تا رسیدن درآمد سالانه شرکت کاربر به ۲۰ میلیون دلار،…

بسیاری از توسعهدهندگان عاملهای هوش مصنوعی را بر اساس «حس» و تجربه شخصی تنظیم میکنند، نه داده. این چارچوب جدید با تفکیک تعریف استاتیک عامل از نمونههای زنده، هرگونه پیشرفت در…

شرکت OpenAI مدعی است مدل جدیدش در بنچمارک منطقی ARC-AGI-3 از رقیب خود پیشی گرفته است. با این حال، این موفقیت تنها با استفاده از یک محیط آزمایشی سفارشی و نه استاندارد به دست آمده…