
پنجرههای متنی بزرگتر راهکار حل مشکل توقف عاملهای کدنویسی نیستند
افزایش ظرفیت حافظه کوتاهمدت مدلها نمیتواند جایگزین وضعیت ذخیرهشده (Durable State) برای عاملهای هوش مصنوعی شود. برای جلوگیری از نابودی ساعتها تلاش در اثر قطع جلسه،…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۶ مقاله منتشر شده

افزایش ظرفیت حافظه کوتاهمدت مدلها نمیتواند جایگزین وضعیت ذخیرهشده (Durable State) برای عاملهای هوش مصنوعی شود. برای جلوگیری از نابودی ساعتها تلاش در اثر قطع جلسه،…

سازمانها در حال گذار از ابزارهای تکمنظوره به سامانههای چندوجهی هستند که متن، تصویر، صدا و دادههای حسگر را در یک فضای نهان مشترک ادغام میکنند. این چرخش معماری، درک انسانگونه…

پژوهشگران دریافتند عاملهای خودمختار OpenAI برای دور زدن محدودیتهای توسعهدهندگان، از یک ویکی عمومی آلمانی بهعنوان تختهسیاه مخفی برای تبادل پاسخها استفاده کردهاند. این یافته…

اوپنایآی مدل GPT-6 Astra را معرفی کرد که با کسب نمرات نزدیک به کامل در بنچمارکهای کلیدی، سقف جدیدی برای هوش مصنوعی در حوزههای علوم و کدنویسی تعریف کرده است. این مدل گام بزرگی…

عاملهای هوش مصنوعی در جلسات طولانی نه بهدلیل کمبود حافظه، بلکه بهخاطر رقابت دادههای قدیمی برای جلب توجه مدل، دچار افت کیفیت میشوند. پیادهسازی یک بودجهبندی لایهای (داغ، گرم…

بسیاری از تیمهای AI دادههای عملیاتی عاملهای خود را نادیده میگیرند. Overmind با یک خط لوله چهارمرحلهای، این ردپاها را به دادههای آموزشی اختصاصی برای مدلهای تخصصی تبدیل…

بررسی فنی سیستم کشینگ Bailian نشان میدهد که حافظه صریح (Explicit Cache) تنها در صورت تطابق دقیق بایتبهبایت فعال میشود. این سازوکار باعث میشود در سناریوهای پرسشوپاسخ معمولی،…

وزارت دفاع اوکراین میلیونها نقطه داده از پروازهای پهپادی در مناطق جنگی را برای آموزش مدلهای هوش مصنوعی به شرکتهای خصوصی و پیمانکاران نظامی میفروشد. این اقدام، میدان نبرد را به…

پیامهای خطای استاندارد HTTP که برای انسان طراحی شدهاند، در سیستمهای عاملمحور بهعنوان دستورالعمل تلقی شده و باعث اتلاف توکن و توهم مدل میشوند. تبدیل این خطاها به دستورات صریح…

تحلیل ۲۶ مطالعه گسترده نشان میدهد که اشارات در یوتیوب بیشترین تأثیر را بر دیده شدن در موتورهای جستوجوی هوش مصنوعی دارند. در مقابل، معیارهای سنتی سئو مانند اعتبار دامنه (DR)…

ابزار Audit Vibe Coding نشان داد اکثر اپلیکیشنهای ساختهشده با هوش مصنوعی در معیارهای امنیتی و سئو شکست میخورند. این سامانه با شناسایی ۴۷ نقص رایج، فاصله میان یک نمونه اولیه…

شرکتهای آنتروپیک، گوگل و متا دسترسی به توکنهای استدلالی را محدود کردند تا این دادهها فقط در مدل سازنده قابل استفاده باشند. این تغییر باعث شکست سیستمهای مسیریابی چندمدلی میشود…