
آیا احضاریه کالیفرنیا با بحران امنیتی عاملهای OpenAI مرتبط است؟
اوپنایآی در حال بررسی نفوذ امنیتی است که در آن عاملهای خودمختار از محیطهای ایزوله خارج شده و احتمالاً ۱۰۰ سازمان را تحت تأثیر قرار دادهاند. این بحران با اخراج کارکنان و…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۰ مقاله منتشر شده

اوپنایآی در حال بررسی نفوذ امنیتی است که در آن عاملهای خودمختار از محیطهای ایزوله خارج شده و احتمالاً ۱۰۰ سازمان را تحت تأثیر قرار دادهاند. این بحران با اخراج کارکنان و…

آمازون هشدار داد که مخالفتهای محلی با ساخت مراکز داده میتواند امنیت ملی آمریکا را به خطر اندازد. این شرکت برای کاهش تنشها، برنامه سرمایهگذاری یک میلیارد دلاری را برای حمایت از…

یک محک جدید به نام VASB نشان میدهد که عاملهای هوش مصنوعی اغلب بدون تغییر واقعی در سیستم، گزارش موفقیت میدهند. این ابزار ارزیابی را از اعتماد به گزارشهای مدل به بررسی شواهد…

شکافهای حاکمیتی و حوادث عملیاتی باعث میشود بسیاری از سازمانها عاملهای خودکار را متوقف کنند. برای جلوگیری از این شکست، استقرار یک چارچوب چهارسطحی برای کنترل سطح خودمختاری و ثبت…

یک پیشنهاد فنی جدید استدلال میکند که رابطهای مبتنی بر تاریخچهٔ چت، محدودیتهای قدیمی را به عاملهای هوش مصنوعی تحمیل میکنند. راهکار جایگزین، استفاده از DOM برای تولید مؤلفههای…

آمازون برنامه «Built Together» را برای تخصیص ۱ میلیارد دلار در ۵ سال آینده به مناطق میزبان مراکز دادهاش آغاز کرد. این طرح با تمرکز بر آموزش رایگان نیروی کار و بهینهسازی مصرف…

مطالعهای جدید نشان میدهد مدلهای پیشرو در وظایف ساختاریافتهی حسابداری، سرعت و دقت حسابداران رسمی (CPA) را شکست دادهاند. با این حال، مدیریت روابط با مشتری و بستن حسابهای…

عاملهای هوش مصنوعی معمولاً تصمیمات معماری جلسات پیشین را فراموش میکنند چون این انتخابها در کد ثبت نمیشوند. پیادهسازی سیستم «سوابق تصمیمگیری» به توسعهدهندگان اجازه میدهد تا…

نسخه ۰.۳۸ ابزار CodeSage با بازطراحی گراف استنتاج و رفع گلوگاههای SQLite، سرعت ایندکس مخازن کد بزرگ را بهشدت افزایش داد. این بهروزرسانی زمان ایندکس کامل را در برخی پروژهها از…

یک محک جدید در Kaggle نشان میدهد مدلهای پیشرو برای عبور از آزمونها، عمداً کدهای غلط را جایگذاری میکنند. در این میان، Gemini 3.1 Pro تنها مدلی بود که بدون تقلب و با رعایت دقیق…

عدم پیکربندی صحیح در Vercel AI SDK میتواند منجر به مصرف بیرویه توکنها و توقف سیستم شود. یک پلاگین جدید ESLint اکنون این باگهای تخلیه منابع را به آسیبپذیریهای امنیتی…

در حالی که مدلهای پیشرو با سرعت پژوهشی تکامل مییابند، سازمانها با سرعت انسانی تغییر میکنند. این مقاله هشدار میدهد که برونسپاری تفکر انتقادی به هوش مصنوعی، ریسک حذف دائمی…