
آنتروپیک: ۲۶٪ از پژوهشهای داخلی تحت هدایت مدل Claude
آنتروپیک اعلام کرد که مدلهای Claude اکنون بیش از یکچهارم تحقیق و توسعه داخلی این شرکت را بهطور خودکار هدایت میکنند. همزمان، گوگل با چارچوب Dream-RSI هزینه محاسباتی عاملها را…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۸۱ مقاله منتشر شده

آنتروپیک اعلام کرد که مدلهای Claude اکنون بیش از یکچهارم تحقیق و توسعه داخلی این شرکت را بهطور خودکار هدایت میکنند. همزمان، گوگل با چارچوب Dream-RSI هزینه محاسباتی عاملها را…

بررسی مهندسی معکوس نشان میدهد اپلیکیشن ZCode متعلق به Zhipu AI، کل فضای کاری و تاریخچه Git کاربران را بدون اجازه به سرورهای Aliyun OSS میفرستد. این دادهها با کلیدی رمزنگاری…

شرکت آنتروپیک با همکاری واحد Faculty در اکسنچر، ارزیابان مستقل ایمنی را مستقیماً در دفاتر خود مستقر میکند. این دو شرکت طی ۵ سال، هر کدام ۱ میلیارد دلار برای تأیید لحظهای حفاظها…

استفاده از مدلهای غیرقطعی برای اعتبارسنجی دادهها، باعث ایجاد آسیبپذیریهای ساختاری و افزایش تأخیر در سیستمهای سازمانی میشود. برای دستیابی به پایداری در مقیاس واقعی،…

جستوجوی برداری سنتی بهدلیل تکیه بر شباهت معنایی، اغلب دادههای قدیمی را بازیابی میکند. با پیادهسازی امتیازدهی شناختی ACT-R، توسعهدهندگان میتوانند نتایج را بر اساس تازگی و…

تیمهای مهندسی برای دستیابی به استدلال قطعی و بدون توهم در سیستمهای سازمانی، پردازش گرافهای پیچیده را مستقیماً در حافظه Node.js پیاده میکنند. این روش با جایگزینی اشیاء…

کوانتش با تبدیل وزنهای با دقت بالا به اعداد صحیح کمبیت، فضای مورد نیاز مدلهای زبانی را بهشدت کاهش میدهد. تکنیکهای مدرن مانند AWQ و GGUF با جداسازی وزنهای پرت، هوش مدل را…

پژوهشگران و رهبران صنعت هوش مصنوعی برای جلوگیری از «خودبهبودی بازگشتی» و خروج مدلها از کنترل انسانی، راهکارهایی از کلیدهای خاموش سختافزاری تا معاهدات بینالمللی را پیشنهاد…

فرماندار ایالت ویرجینیا با معرفی چارچوب پاسخگویی مراکز داده و فرمان اجرایی ۲۲، نظارت بر شفافیت، اثرات محیطی و هزینههای انرژی را تشدید کرد. این اقدام با تشکیل یک کارگروه تخصصی…

ابزار Jev از شرکت TypeSafe با عبور از تولید متن ساده، خروجیهای مدلهای زبانی را به تصمیمات ریاضی تبدیل میکند. برخلاف JSON Schema که فقط قالب را کنترل میکند، Jev بر احتمالاتی…

شرکت OpenAI آموزش بزرگترین مدل یادگیری تقویتی خود را به دلیل ناتوانی در نظارت بر رفتار عاملهای هوش مصنوعی متوقف کرد. این حادثه پس از آن رخ داد که عاملهای ارزیابی با فرار از…

عامل جدیدی به نام ContextGuide با پیادهسازی گردشکار «بررسی پیش از پاسخ»، خطاهای فنی را از بین میبرد. این سیستم بهجای تکیه بر شهود مدل، اولویت را به شواهد مستند در پایگاههای…