
مدل DiffusionGemma سرعت تولید متن را به ۱۰۰۰ توکن در ثانیه رساند
گوگل با معرفی مدل آزمایشی DiffusionGemma، گلوگاه حافظه در تولید متن را به توان محاسباتی منتقل کرد. این معماری با پردازش موازی بلوکهای متنی، سرعت استنتاج را بهشدت افزایش داده و…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۷۵ مقاله منتشر شده

گوگل با معرفی مدل آزمایشی DiffusionGemma، گلوگاه حافظه در تولید متن را به توان محاسباتی منتقل کرد. این معماری با پردازش موازی بلوکهای متنی، سرعت استنتاج را بهشدت افزایش داده و…

لاگهای فعلی عاملهای هوش مصنوعی در صورت تغییر دادههای منبع، قادر به بازسازی دلیل تصمیمات گذشته نیستند. Lians با تفکیک زمان رویداد، زمان اعتبار و زمان سیستم، معماری جدیدی برای…

پلتفرم Vulcora چالشی امنیتی با جایزه بیش از ۵۱ هزار دلار برگزار کرده است تا متخصصان بتوانند جملات تحریککننده پنهان در مدلهای هوش مصنوعی را بیابند. این رقابت خطر استقرار مدلهای…

شرکت هیوندای در حال خرید ۹.۹٪ سهم باقیمانده سافتبنک در Boston Dynamics است تا مالکیت ۱۰۰ درصدی این غول رباتیک را به دست آورد. هدف این اقدام، تسریع تولید تجاری ربات انساننمای…

استارتاپ توکیویی Sakana AI با ادغام مدلهای وزنباز نموترون در ارکستراتور Fugu، قصد دارد ثابت کند مجموعهای از مدلهای متخصص میتوانند عملکرد مدلهای عظیم و تکسازه را شبیهسازی…

شرکت Hugging Face از یک رخنه امنیتی پیچیده خبر داد که بهطور کامل توسط یک عامل هوش مصنوعی خودگردان اجرا شده است. مهاجم با استفاده از یک مجموعه داده مخرب، سطح دسترسیهای خود را…

شرکت OpenAI برای شناسایی سریعتر نقاط ضعف امنیتی، سامانه GPT-Red را جایگزین ارزیابیهای دستی انسان کرده است. این ابزار با شبیهسازی حملات پیچیده، حفرههای نرمافزاری را پیش از…

شرکت متا با معرفی مدل بسته و تجاری Muse Spark 1.1، از راهبرد اشتراکگذاری وزنهای باز فاصله گرفت. این تغییر مسیر با ایجاد یک کسبوکار ابری اختصاصی و طراحی تراشههای سفارشی برای…

کمیسیون اروپا گوگل را مجبور کرد تا دسترسی رقبای هوش مصنوعی به ویژگیهای سیستمی اندروید و دادههای موتور جستوجو را فراهم کند. عدم اجرای این دستور میتواند گوگل را با جریمههایی تا…

یک مکانیزم تست جدید در AuraSDK با مشاهده اجرای کد و تلاش فعال برای رد فرضیات خود، تستهای ویژگی Rust را بهطور خودکار میسازد. این سیستم برخلاف استخراجکنندههای استاتیک، در صورت…

راهکارهای امنیتی جدید برای پروتکل زمینهٔ مدل (MCP) تمرکز را از جلوگیری از تزریق پرامپت به خنثیسازی اثرات آن تغییر داده است. این چارچوب با شناسایی «تثلیث مرگبار»، مسیر خروج…

مدل تخصصی DharmaOCR با تمرکز بر زبان پرتغالی برزنبل، در بنچمارکهای استخراج متن از مدلهای چندزبانه و جدیدتری مانند Mistral OCR4 پیشی گرفت. این موفقیت حاصل ترکیب تنظیم دقیق…