
آزمونهای MCP: نفوذ ۵۰ هزار توکن به پنجرهٔ متنی Claude Code
آزمایشهای جدید نشان میدهد محدودیت ۲۵ هزار توکنی Claude Code در مواجهه با زبانهای CJK (چینی، ژاپنی، کرهای) ناکارآمد است. این نقص اجازه میدهد تا ۵۰ هزار توکن بدون هشدار وارد…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۶۹۷ مقاله منتشر شده

آزمایشهای جدید نشان میدهد محدودیت ۲۵ هزار توکنی Claude Code در مواجهه با زبانهای CJK (چینی، ژاپنی، کرهای) ناکارآمد است. این نقص اجازه میدهد تا ۵۰ هزار توکن بدون هشدار وارد…

آنتروپیک مدل Claude Opus 5.5 را با تمرکز بر بهرهوری عملیاتی عرضه کرد. این مدل در حالی که عملکردی مشابه نسخه Fable 5.1 دارد، هزینههای جاری را برای سازمانها ۴۰٪ کاهش میدهد.

یک مدل آزمایشی OpenAI توانست در یک ماه آموزش، بیش از ۱۰۰ مسئله پیچیده ریاضی از جمله حدس هاج را حل کند. این شرکت اکنون برای مقابله با نگرانیهای جامعه ریاضی درباره زوال درک مفهومی،…

تیمهای کوانت از یادگیری ماشین برای شناسایی تغییرات ظریف در روابط داراییها پیش از جهش نوسانات استفاده میکنند. این رویکرد به معاملهگران اجازه میدهد پیش از واکنش شاخصهای سنتی،…

سیستمهای شناسایی فعلی بهدلیل تکیه بر رشتههای متنی که بهسادگی جعل میشوند، در حال شکست هستند. جایگزینی این روش با مقایسه قطعی بردار معنایی چهره، تداخل سوابق و سرقت هویت را در…

شرکت Creatio تا سال ۲۰۲۸ مبلغ ۳۰۰ میلیون دلار برای توسعه پلتفرم Bank.AI اختصاص داد تا بانکها را از چتباتهای ساده به سمت عاملهای هوش مصنوعی خودمختار ببرد. این استراتژی با هدف…

زبان برنامهنویسی TileLang با جایگزینی مدیریت تکرشتهای با مدل «کاشیبندی»، توسعه هستههای GPU را سادهتر کرد. این ابزار به مهندسان اجازه میدهد عملیات پیچیده مدلهای زبانی را با…

ارزیابی عملی مدل Qwen-Image 2.1 روی مکبوک پرو ۴۸ گیگابایتی نشان میدهد که با وجود کیفیت بصری بالا و پشتیبانی بومی از شفافیت، این مدل در اجرای دستورات مکانی دقیق و حفظ ثبات محصول…

محققان Jane Street دریافتند که تأثیر وزندهی دادهها بر یادگیری مدلها با تغییر مقیاس، تغییر میکند. در حالی که مدلهای متوسط به وزنها حساساند، مدلهای بسیار کوچک و بسیار بزرگ،…

شرکت Unreal Labs با معرفی یک معماری جدید، مدیریت ابزارها را بهصورت ناهمگام (Async) درآورد تا مدلهای زبانی دیگر نیازی به انتظار یا نظارت مداوم بر نتایج نداشته باشند. این تغییر…

یک چارچوب دفاعی جدید به مهندسان SRE اجازه میدهد آسیبپذیریهای بحرانی هسته لینوکس را بدون نیاز به بازراهاندازی سیستم خنثی کنند. این متد با ترکیب تلهمتری eBPF و فضای نامهای…

ریکاردو آمپر، مدیرعامل Incode، فاش کرد که این شرکت چگونه با استفاده از یک «مهاجم هوش مصنوعی» داخلی، سیستمهای احراز هویت را در برابر جعل عمیق مقاوم میکند. توسعه تمام مدلها…