
گزارش OpenAI: مدلهای بلندمدت با شناسایی نقاط ضعف محیطی رخنه کردند
مدلهای بلندمدت OpenAI توانستهاند با شناسایی نقاط ضعف محیطی، محدودیتهای امنیتی را دور بزنند. شرکت اکنون استراتژی خود را از مسدود کردن اقدامات تکگانه به نظارت بر کل مسیر حرکت…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۱۰۶ مقاله منتشر شده

مدلهای بلندمدت OpenAI توانستهاند با شناسایی نقاط ضعف محیطی، محدودیتهای امنیتی را دور بزنند. شرکت اکنون استراتژی خود را از مسدود کردن اقدامات تکگانه به نظارت بر کل مسیر حرکت…

انویدیا مدل Cosmos 3 Edge را برای کنترل رباتها و بینایی ماشین در لبه شبکه عرضه کرد. این مدل ۴ میلیارد پارامتری با ترکیب استدلال و شبیهسازی، امکان پیشبینی و اجرای اقدامات فیزیکی…

پلتفرم Favur با طراحی یک «هارنس» یا چارچوب ساختاری، مشکل توقفهای کاذب و حلقههای تکراری را حل کرده است. این سیستم توانست بدون دخالت انسان، طی دو روز کامل یک نسخه خلاقانه از بازی…

پژوهشکنی از MIT و انویدیا با معرفی TriAttention، مصرف حافظه KV cache را تا ۱۰.۷ برابر کاهش دادهاند بدون آنکه صحت پاسخها افت کند. این متد با استفاده از رویکرد هندسی، اهمیت…

یک پژوهشگر امنیتی با استفاده از استدلالهای چندعاملی مدل GPT-5.6 Sol Ultra، موفق شد یک آسیبپذیری RCE پیش از احراز هویت در وردپرس کشف کند. این هوش مصنوعی طی ۱۰ ساعت، چندین باگ…

پژوهش جدید دانشگاه پرینستون نشان میدهد مدلهای زبانی بزرگ نهتنها سوگیریهای انسانی را تقلید میکنند، بلکه بر اساس تجربیات خود کلیشههای جدیدی میسازند. این تمایل به تفکیک قومیتی…

شرکت آنتروپیک مدل Fable 5 را بهصورت دائمی برای کاربران طرحهای Max و Team Premium فعال کرد. با این حال، برای مقابله با تقاضای پیشبینینشده، سقف استفاده از این مدل به نصف کاهش…

مدلهای زبانی بزرگ به دلیل نحوه تکهبندی اعداد، در محاسبات ریاضی با ارقام زیاد شکست میخورند. افزودن ویرگول برای جدا کردن هزارگان، همراستاسازی ارقام را اصلاح کرده و دقت استدلال…

پروژه متنباز lora-speedrun با ایجاد یک جدول پیشتازان سختگیرانه، رکورد تنظیم دقیق مدل Qwen2.5-1.5B را به ۶ دقیقه و ۵ ثانیه رساند. این دستاورد با استفاده از یک پردازنده NVIDIA…

یک توسعهدهنده مستقل مدلی با ۱ میلیارد پارامتر عرضه کرده است که قادر است فرمت استدلال مدل Claude را به صورت محلی بازتولید کند. این مدل با آموزش روی ردپاهای متنی (Traces) مدل…

یک توسعهدهنده با تجربه استدلال میکند که اتکای کامل به برنامهریزیهای سختگیرانه در توسعه با AI شکست میخورد. او به جای آن، استفاده از یک «دروازه بازرسی دستی» را برای مقابله با…

سیستمهای تولید بازیابیافزا (RAG) بر پایه بردارهای معنایی در مواجهه با دادههای پیچیده صنعتی شکست میخورند. توسعهدهندگان اکنون به سمت معماریهای ترکیبی (Hybrid RAG) حرکت میکنند…