
آنتروپیک: کاهش ۸۵ درصدی مسدودسازیهای اشتباه در حوزه زیستشناسی
آنتروپیک با بهروزرسانی فیلترهای ایمنی Fable 5، نرخ خطای مثبت در پرسوجوهای زیستشناسی را بهشدت کاهش داد تا دسترسی به دادههای پزشکی و آموزشی تسهیل شود. با این حال، محدودیتهای…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۲۶ مقاله منتشر شده

آنتروپیک با بهروزرسانی فیلترهای ایمنی Fable 5، نرخ خطای مثبت در پرسوجوهای زیستشناسی را بهشدت کاهش داد تا دسترسی به دادههای پزشکی و آموزشی تسهیل شود. با این حال، محدودیتهای…

شرکت OpenAI توسعه مدل Astra را به دلیل توانایی این مدل در شناسایی و ایجاد اکسپلویتهای روز-صفر (Zero-day) بدون کمک انسان متوقف کرد. این شرکت اکنون پروتکلهای مهار شدیدی را فعال…

ظرفیت اعلامشده برای پنجرههای متنی تنها یک سقف سختافزاری است، نه تضمینی برای کیفیت استخراج داده. توسعهدهندگان باید برای جلوگیری از خطاهای «گمشدن در میانه» و هزینههای تصاعدی،…

رتبهبندیهای عمومی مدلهای زبانی اغلب برای توسعهدهندگان گمراهکننده است، زیرا نمرات آکادمیک محدودیتهای دنیای واقعی را پوشش نمیدهند. رویکرد مسیریابی وظایف (Task-specific…

شرکت اوراکل برای کاهش ریسکهای امنیتی و حقوقی، ارسال کدهای تولیدشده توسط هوش مصنوعی به پروژه OpenJDK را ممنوع کرد. این تصمیم در حالی اتخاذ شده که مدیریت اوراکل مدعی است بخش بزرگی…

یک چارچوب ارزیابی جدید نشان میدهد که مدلهای زبانی در نقش معلم، تمایل دارند بیش از حد به دانشآموز کمک کنند و فرصت «تلاش سازنده» را از آنها بگیرند. با وجود بهبود در مهندسی…

پلتفرم Oxlo.ai برای حذف «مالیات تأخیر» در سیستمهای تعاملی، پرداخت بر اساس توکن را با هزینه ثابت بهازای هر درخواست جایگزین کرد. این رویکرد به توسعهدهندگان اجازه میدهد بدون…

یک مطالعه بر روی ۷۲ آزمایش نشان میدهد که فشردهسازی خروجیهای ابزار در پروتکل MCP باعث میشود عاملها از انجام وظایفی که قادر به حل آنها هستند، صرفنظر کنند. این پژوهش ثابت…

مدل Astra توانایی شناسایی و توسعهٔ خودکار حفرههای امنیتی (Zero-day) را پیدا کرده است. OpenAI برای جلوگیری از سوءاستفاده، دسترسیهای داخلی را محدود و نظارت بر زنجیره تفکر مدل را…

شرکت Lemma زیرساختی برای شناسایی «شکستهای معنایی» ایجاد میکند؛ جایی که عاملهای هوش مصنوعی بهظاهر موفق عمل میکنند اما نتایج غلط تولید میکنند. هدف این پلتفرم تبدیل خطاهای…

یک شکاف امنیتی گسترده بیش از ۲۱ هزار نمونه از عاملهای OpenClaw را در معرض دسترسی عمومی قرار داده و کلیدهای API و دسترسیهای سیستمی کاربران را به سرقت انداخته است. این پروژه به…

یک گزارش مهندسی دقیق، ساخت ربات جاروبرقی خودگردان با استفاده از ROS 2 Jazzy و Gazebo Harmonic را بررسی میکند. تمرکز اصلی این پروژه بر ایجاد یک لایه انتزاعی است تا کد نرمافزاری…