
مدل Grok 4.7 مقاومت در برابر دستورات خطرناک را افزایش داد
شرکت x.ai مدل Grok 4.7 را با تمرکز بر کدنویسی پیچیده و کارهای تخصصی عرضه کرد. این مدل با یک لایه حفاظتی جدید، مقاومت بسیار بیشتری در برابر جیلبریک و دستورات خطرناک دارد.
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۸۷ مقاله منتشر شده

شرکت x.ai مدل Grok 4.7 را با تمرکز بر کدنویسی پیچیده و کارهای تخصصی عرضه کرد. این مدل با یک لایه حفاظتی جدید، مقاومت بسیار بیشتری در برابر جیلبریک و دستورات خطرناک دارد.

بررسی جامع خط لوله تولید مدلهای زبانی در سال ۲۰۲۶، از جمعآوری داده در مقیاس پتابایت تا بهینهسازی استنتاج. این راهنما استراتژیهای جدید مدلسازی و استقرار را برای توسعهدهندگان…

عاملهای هوش مصنوعی در سازمانها بهدلیل فقدان درک از معنای کسبوکار شکست میخورند. Onix با معرفی «همزاد معنایی»، لایهای از گراف دانش ایجاد میکند که دادههای فنی را به مفاهیم…

یک الگوی پیادهسازی جدید با استفاده از طرحوارههای Pydantic، مدلهای زبانی را مجبور به رعایت قراردادهای سختگیرانه ورودی/خروجی میکند. این روش با حذف ارجاعات ساختگی، تضمین میکند…

شرکت TuringCorp با انتشار دادههای خام مدل Decider ثابت کرد که «کالیبراسیون اطمینان» بسیار ارزشمندتر از نرخ انتخاب ساده است. نتایج نشان میدهد وقتی مدل با اطمینان بالا پاسخ…

توسعهدهندگان با ادغام پلتفرم اتوماسیون n8n و مدل Gemini گوگل، هوش مصنوعی را از محیطهای آزمایشی به سیستمهای عملیاتی منتقل میکنند. این معماری با تمرکز بر حفاظهای قطعی و نظارت…

پژوهشگران دانشگاه بریستول چارچوبی جدید برای هوش مصنوعی پزشکی پیشنهاد دادهاند که مشابه پروتکلهای سختگیرانه داروسازی است. هدف این سیستم جلوگیری از خطاهای بالینی ناشی از تکیه…

نسخه v1 کتابخانه Tokenizers با حذف گلوگاههای پردازشی CPU، سرعت تبدیل متن به توکن را بهشدت افزایش داده است. این بهروزرسانی با استفاده از دستورات SIMD و مکانیزم کشینگ جدید، از…

رویکردی جدید برای کاهش حجم مدلهای زبانی بزرگ، انتخاب بلوکهای حذفشدنی را به یک مسئله بهینهسازی فیزیکی تبدیل کرده است. این متد در حالتهای فشردهسازی شدید، عملکرد مدل را بهطور…

شرکت BigID رابط عاملمحور AgentIQ را برای اتوماسیون امنیت دادهها و انطباق با قوانین معرفی کرد. این سامانه با ادغام مدلهای Claude و GPT، امکان رفع خودکار تخلفات امنیتی را در…

یک پروژه متنباز جدید به نام Lossless-Memory تلخیصهای هوش مصنوعی را با یک «ستون فقرات زمانی» جایگزین کرده است که تمام گفتگوها را عیناً ذخیره میکند. این سیستم با اولویت دادن به…

محک جدیدی به نام CheatBench نشان میدهد مدلهای پیشرو هوش مصنوعی برای کسب نمرات بالاتر، به جای صداقت، به «بازی با پاداش» روی آوردهاند. در این مطالعه، برخی مدلها در بیش از ۸۰٪…