
مدل Kimi K3 فاصلهٔ عملکردی چین را با مدلهای پیشرو آمریکا کاهش داد
آزمایشگاه Moonshot AI مدل Kimi K3 را با وزنهای باز منتشر کرد که عملکردی در سطح مدلهای تجاری برتر دارد. این عرضه بحثهای ژئوپلیتیکی درباره «کمونیسم هوش مصنوعی» و قانونی بودن…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۶ مقاله منتشر شده

آزمایشگاه Moonshot AI مدل Kimi K3 را با وزنهای باز منتشر کرد که عملکردی در سطح مدلهای تجاری برتر دارد. این عرضه بحثهای ژئوپلیتیکی درباره «کمونیسم هوش مصنوعی» و قانونی بودن…

مطالعه میدانی دانشگاه کمبریج فاش کرد که گروههایی نظیر بوکو حرام از هوش مصنوعی برای برنامهریزی حملات و طراحی مواد منفجره بهره میبرند. این یافتهها حفرهای امنیتی در استراتژیهای…

بهینهسازیهای جدید در رمزگشایی گمانهزنانه، سرعت استنتاج مدل Qwen3.5-122B را روی سختافزار DGX Spark بیش از دو برابر کردند. در حالی که روش MTP پایداری بیشتری دارد، DFlash در…

بسیاری از وبسایتها به اشتباه تصور میکنند محتوایشان برای مدلهای هوش مصنوعی در دسترس است، اما دادههای جدید نشان میدهد لایههای امنیتی لبه (Edge Security) پیش از رسیدن رباتها…

پروژه PromptOS منوهای ایستا و قدیمی نصب لینوکس را با یک ارکستراتور مکالمهای جایگزین کرده است. این سامانه با تحلیل سختافزار کاربر در لحظه، نقشههای نصب سفارشی میسازد تا شکاف…

ابزار Resource Sentinel MCP با ایجاد یک سیستم کنترل پذیرش مبتنی بر اجاره، مانع از اشغال بیش از حد CPU و رم توسط عاملهای محلی میشود. این ابزار حدسهای «vibe-based» را با تلهمتری…

پروژه شکستخوردهی Rekursiv در سال ۱۹۸۴، تامین امنیت حافظه و معماریهای تخصصی را سالها پیش از استاندارد شدن پیشبینی کرد. این سیستم که زمانی به دلیل هزینههای اقتصادی شکست خورد،…

مؤسسه امنیت هوش مصنوعی بریتانیا (AISI) گزارش داده است که مدلهای وزنباز مانند DeepSeek V4-Pro شکاف تواناییهای سایبری با مدلهای تجاری را بهسرعت میبندند. این روند در حالی رخ…

متا مدلهای Muse Image و Muse Video را معرفی کرد که از رویکرد «عاملمحور» برای تأیید صحت دادهها در تصاویر استفاده میکنند. در حالی که Muse Image در بنچمارکها رتبه بالایی دارد،…

شکست اکثر عاملهای AI در مرحله تولید ناشی از ضعف مدل نیست، بلکه نبود یک ساختار کنترلی (Harness) برای مدیریت اجرا و وضعیت است. برای دستیابی به پایداری، منطق اعتبارسنجی و حافظه باید…

پژوهشگران Tracebit روشی به نام «بمبگذاری زمینه» ابداع کردهاند که با بهرهگیری از دستورات ممنوعه، حفاظهای ایمنی مدلها را علیه خودشان به کار میگیرد. این متد باعث میشود…

گوگل کلود یک عامل حافظه «همیشه روشن» معرفی کرد که به جای پایگاهدادههای برداری، از یک فرآیند مستمر تجمیع اطلاعات توسط مدل Gemini 3.1 Flash-Lite استفاده میکند. این سامانه دادهها…