پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۷۲ مقاله منتشر شده

سازوکار M2A: تزریق استدلال ریاضی به عامل‌های هوش مصنوعی بدون آموزش مجدد

سازوکار M2A: تزریق استدلال ریاضی به عامل‌های هوش مصنوعی بدون آموزش مجدد

رویکرد جدید M2A با ادغام پارامترها در فضای تهی، توانایی استدلال ریاضی را به عامل‌های هوش مصنوعی تزریق می‌کند بدون آنکه نیاز به آموزش مجدد باشد. این متد نرخ حل مسائل SWE-Bench در…

۲ دقیقه خواندن۳
چگونه «عمق تعهد یادگیرای» مدل‌های کوچک را در استدلال از GPT-5.5 پیشتاز کرد؟

چگونه «عمق تعهد یادگیرای» مدل‌های کوچک را در استدلال از GPT-5.5 پیشتاز کرد؟

یک مدل ۷ میلیارد پارامتری با استفاده از متغیر «عمق تعهد یادگیرای»، در وظایف استدلالی بلندمدت از GPT-5.5 و Claude Sonnet پیشی گرفت. این رویکرد با بهینه‌سازی زمان بازطراحی…

۲ دقیقه خواندن۳
چرا برابری در نتایج هوش مصنوعی، تضمینی برای عدالت در استدلال نیست؟

چرا برابری در نتایج هوش مصنوعی، تضمینی برای عدالت در استدلال نیست؟

یک چارچوب نظری جدید مفهومی به نام «سوگیری رویه‌ای» را معرفی می‌کند که در آن مدل‌ها نتایجی عادلانه تولید می‌کنند اما بر اساس منطقی تبعیض‌آمیز. این پژوهش متدی برای حسابرسی و تضمین…

۲ دقیقه خواندن
چرا Gemini 2.5 Flash در پیش‌بینی دشواری وظایف شکست می‌خورد؟

چرا Gemini 2.5 Flash در پیش‌بینی دشواری وظایف شکست می‌خورد؟

ابزار جدیدی به نام کاوشگر فراشناختی نشان می‌دهد که مدل‌های پیشرو می‌توانند در یک بُعد از اطمینان دقیق باشند اما در بُعدی دیگر به‌طور کامل شکست بخورند. این یافته نقطه کوری حیاتی در…

۲ دقیقه خواندن۱
بنچمارک EnactToM: شکست ۱۰۰ درصدی مدل‌های پیشرو در وظایف کاربردی نظریه ذهن

بنچمارک EnactToM: شکست ۱۰۰ درصدی مدل‌های پیشرو در وظایف کاربردی نظریه ذهن

مدل‌های پیشرو در درک باورهای دیگران موفق‌اند اما در محیط‌های سه‌بعدی نمی‌توانند بر اساس این دانش عمل کنند. بنچمارک جدید EnactToM نشان می‌دهد هفت مدل برتر در تمامی وظایف دشوار…

۲ دقیقه خواندن۱
گزارش Palisade: سرعت تکثیر عامل‌های هوش مصنوعی از آمریکا تا هند در ۵۰ دقیقه

گزارش Palisade: سرعت تکثیر عامل‌های هوش مصنوعی از آمریکا تا هند در ۵۰ دقیقه

هوش مصنوعی از یک ابزار کمکی به عامل‌های خودکاری تبدیل شده که قادر به تکثیر سریع و حتی بازنویسی درایورهای سیستم هستند. این تحول، معماری مراکز داده را به سمتی می‌برد که در آن…

۳ دقیقه خواندن۲
چرا در مقیاس Blackwell، زیرساخت شبکه به متغیر تعیین‌کننده جایگزین FLOPS شد؟

چرا در مقیاس Blackwell، زیرساخت شبکه به متغیر تعیین‌کننده جایگزین FLOPS شد؟

شرکت AWS معماری چهارلایه جدیدی را برای پشتیبانی از «سه قانون مقیاس‌پذیری» مدل‌های بنیادی معرفی کرد. این ساختار با ادغام پردازنده‌های NVIDIA Blackwell و شبکه EFAv4، تلاش می‌کند…

۲ دقیقه خواندن۱
چگونه Agent Memory Guard جلوی مسمومیت حافظه در عامل‌های هوش مصنوعی را می‌گیرد؟
آموزش کاربردی

چگونه Agent Memory Guard جلوی مسمومیت حافظه در عامل‌های هوش مصنوعی را می‌گیرد؟

سازمان OWASP ابزاری متن‌باز برای مقابله با «مسمومیت حافظه» در عامل‌های هوش مصنوعی معرفی کرد. این اسکنر دستورات مخربی را که در حافظه بلندمدت ذخیره شده و در جلسات آینده فعال…

۲ دقیقه خواندن۱
چرا مهارت «ارکستراسیون» مانع جایگزینی انسان‌ها با عامل‌های هوش مصنوعی است؟

چرا مهارت «ارکستراسیون» مانع جایگزینی انسان‌ها با عامل‌های هوش مصنوعی است؟

دارون عجم‌اوغلو، برنده جایزه نوبل اقتصاد، معتقد است عامل‌های هوش مصنوعی به‌دلیل فقدان مهارت «ارکستراسیون» یا مدیریت وظایف متنوع، نمی‌توانند جایگزین انسان شوند. او هشدار می‌دهد که…

۲ دقیقه خواندن۱
Interfaze: پیروزی معماری ترکیبی در ۹ بنچمارک قطعی در برابر Gemini-3-Flash

Interfaze: پیروزی معماری ترکیبی در ۹ بنچمارک قطعی در برابر Gemini-3-Flash

Interfaze یک معماری ترکیبی جدید است که دقت شبکه‌های عصبی قدیمی را با انعطاف‌پذیری ترنسفورمرها ادغام کرده است. این مدل در وظایف قطعی مانند OCR و تبدیل گفتار به متن، مدل‌های Mini…

۲ دقیقه خواندن۲
گزارش بایدو: کاهش ۹۴ درصدی هزینه آموزش Ernie 5.1 در مسیر رقابت با GPT-5.5

گزارش بایدو: کاهش ۹۴ درصدی هزینه آموزش Ernie 5.1 در مسیر رقابت با GPT-5.5

مدل Ernie 5.1 شرکت بایدو با کاهش ۹۴ درصدی هزینه‌های پیش‌آموزش، جایگاه چهارم جهانی را در جدول Arena Search به دست آورد. این مدل با استفاده از یک چارچوب آموزشی الاستیک، توانسته است…

۴ دقیقه خواندن۳