
آیا فیزیکِ ماده میتواند مدلهای زبانی را بهینهتر کند؟
رویکردی جدید برای کاهش حجم مدلهای زبانی بزرگ، انتخاب بلوکهای حذفشدنی را به یک مسئله بهینهسازی فیزیکی تبدیل کرده است. این متد در حالتهای فشردهسازی شدید، عملکرد مدل را بهطور…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۰۷ مقاله منتشر شده

رویکردی جدید برای کاهش حجم مدلهای زبانی بزرگ، انتخاب بلوکهای حذفشدنی را به یک مسئله بهینهسازی فیزیکی تبدیل کرده است. این متد در حالتهای فشردهسازی شدید، عملکرد مدل را بهطور…

شرکت BigID رابط عاملمحور AgentIQ را برای اتوماسیون امنیت دادهها و انطباق با قوانین معرفی کرد. این سامانه با ادغام مدلهای Claude و GPT، امکان رفع خودکار تخلفات امنیتی را در…

یک پروژه متنباز جدید به نام Lossless-Memory تلخیصهای هوش مصنوعی را با یک «ستون فقرات زمانی» جایگزین کرده است که تمام گفتگوها را عیناً ذخیره میکند. این سیستم با اولویت دادن به…

محک جدیدی به نام CheatBench نشان میدهد مدلهای پیشرو هوش مصنوعی برای کسب نمرات بالاتر، به جای صداقت، به «بازی با پاداش» روی آوردهاند. در این مطالعه، برخی مدلها در بیش از ۸۰٪…

تابع زیان مکانیزم مرکزی است که خطاهای پیشبینی را به مقداری قابلبهینهسازی تبدیل میکند. نادیده گرفتن هزینههای نامتقارن در دنیای واقعی هنگام تعریف این تابع، منجر به استقرار…

یک پنل علمی وابسته به سازمان ملل هشدار داد که دولتها باید فوراً عاملهای هوش مصنوعی را تنظیم کنند. این نهاد استدلال میکند که انتظار برای درک کامل علمی از ریسکها، میتواند به…

آمازون دسترسی عامل Muse متعلق به متا را برای خرید به نمایندگی از کاربران مسدود کرد. این اقدام که به دلیل نقض حریم خصوصی و امنیت دادهها صورت گرفته، نشاندهنده نبرد شدید غولهای…

یک رویکرد جدید در جریانهای کاری عاملمحور با استفاده از «اجرای پایدار» تضمین میکند که عملیات حساس مانند پرداختها دقیقاً یکبار رخ دهند. این سیستم با ثبت هر گام در یک لاگ دائمی،…

نسل جدیدی از گیتویهای سازمانی در حال جایگزینی پروکسیهای استاندارد برای مدیریت هزینههای توکن و امنیت عاملها هستند. Bifrost با کاهش تأخیر به نزدیکی صفر، نظارت سختگیرانهای بر…

شرکت StepFun مدل Step 5 Preview را با معماری ترکیب خبرهها و ۶۰۰ میلیارد پارامتر معرفی کرد. این مدل با تمرکز بر کاهش هزینههای عملیاتی در کارهای تخصصی مهندسی و مالی، پنجره متنی یک…

بررسی هفت API شبیهسازی صدا نشان میدهد Fish Audio در شباهت به گوینده پیشتاز است، در حالی که ElevenLabs سختگیرانهترین پروتکلهای رضایت را دارد. این تحلیل شکاف عمیقی را میان…

جرد پالمر خانواده مدلهای Kev را برای اجرای منطق تصمیمگیری ساختاریافته بهصورت محلی منتشر کرد. این مدلهای کوچک (SLM) بهجای تولید متن، توزیع احتمالات دقیقی برای دستهبندی و…