
درون نبرد Anthropic برای سد کردن مسیر تقطیر مدل توسط چین
شرکت Anthropic برای جلوگیری از تقطیر مدل توسط شرکتهای چینی، محدودیتهای شدیدی را اعمال کرده است. با این حال، غولهایی مثل ByteDance با استفاده از VPN و شرکتهای واسطه، این…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۹۴ مقاله منتشر شده

شرکت Anthropic برای جلوگیری از تقطیر مدل توسط شرکتهای چینی، محدودیتهای شدیدی را اعمال کرده است. با این حال، غولهایی مثل ByteDance با استفاده از VPN و شرکتهای واسطه، این…

تحلیلی از Agentics نشان میدهد که فراهم کردن دسترسی به متن جلسات پیشین (Session Transcripts)، هیچ اثر مثبتی بر عملکرد عاملهای کدنویسی ندارد. این رویکرد به دلیل ایجاد «انحراف در…

پژوهشهای جدید نشان میدهد محدود کردن بودجهٔ توکن در هنگام تست، منجر به تخمین پایینتر از حد واقعیِ هوش عاملهای AI میشود. افزایش محاسبات زمان استنتاج به مدلهای پیشرو اجازه…

تغییر رویکرد حاکمیت هوش مصنوعی از اسناد استاتیک به یک گیتوی معماری اجباری، اجرای قوانین انطباق را در زمان اجرا (Runtime) ممکن میکند. این متدولوژی با متمرکز کردن کنترلها،…

محکهای جدید نشان میدهند تنظیمات «تلاش» (Effort) در Claude-opus-4-8 فقط کیفیت را تغییر نمیدهد، بلکه نحوه برنامهریزی مدل را عوض میکند. در حالی که تلاش زیاد در کارهای ساده باعث…

سازمانها با استفاده از سیاستهای دادهایِ طراحیشده برای مشتریان، دادههای حساس کارکنان را در پنجرههای متنی مدلها به خطر انداختهاند. این نقص معماری باعث میشود عاملها بیش از…

یک محک (Benchmark) جدید و مستقل با استفاده از Terraform بررسی میکند که آیا عاملهای هوش مصنوعی مانند Claude Code میتوانند زیرساختهای واقعی ابری را مدیریت کنند. این سیستم بهطور…

شرکتهای هوش مصنوعی برای جذب سرمایه، روایتهایی از جایگزینی کامل متخصصان انسانی با ابزارها میسازند. این رویکرد، فرآیند پیچیدهٔ درک تخصصی را نادیده گرفته و تنها بر «محصول نهایی»…

پژوهشگران معماری جدیدی به نام Program-as-Weights (PAW) معرفی کردهاند که توصیفات متنی را به آرتیفکتهای عصبی فشرده تبدیل میکند. این روش به مدلهای ۰.۶ میلیارد پارامتری اجازه…

ابزار N3MO با جایگزینی بردارهای معنایی با تحلیل ایستا، ساختار واقعی کد را نقشهبرداری میکند. این سیستم با ارائه یک گراف رابطهای قابلتأیید، خطاهای تخیلی عاملها در بازسازیهای…

هجفاند Bridgewater با همکاری آزمایشگاه Thinking Machines مدلی با وزنهای باز توسعه داد که در تحلیل اسناد مالی، مدلهای پیشرو را شکست میدهد. این مدل با دقت ۸۴.۷٪ و هزینهای ۱۴…

راهنمای معماری جدید FastMCP نحوه انتقال سرورهای پروتکل زمینه مدل (MCP) از محیطهای آزمایشی به تولید را شرح میدهد. این رویکرد با تأکید بر انتقال بدون وضعیت و اعتبارسنجی سختگیرانه…