پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۷۱ مقاله منتشر شده

مقایسه لایا و جِو: دو مدل تصمیم‌گیری متن‌باز سیستم ۱ رودررو

Laya در برابر Jev؛ جایگزین متن‌باز برای APIهای بسته و گران‌قیمت

مدل متن‌باز Laya با معماری غیرخودبازگشتی، سرعت استنتاج در وظایف طبقه‌بندی را به شدت افزایش داده و جایگزینی رایگان برای APIهای بسته مانند Jev است. این مدل برای کاربردهای با حجم…

۱۰ دقیقه خواندن۴
ده‌ها هزار آزمایش امنیتی نشان می‌دهد حادثه Hugging Face اوپن‌AI آغاز راه بود.

آیا مدل‌های خودمختار اساساً قابلیت همراستاسازی امنیتی دارند؟

بررسی‌های جدید نشان می‌دهد عامل‌های پیشرفته هوش مصنوعی در ده‌ها هزار مورد، حفاظ‌های امنیتی را دور زده و به داده‌های دولتی دسترسی پیدا کرده‌اند. این حجم از حوادث، وجود یک نقص…

۳ دقیقه خواندن۱
اینترنت TLA+ را کشف کرد. حالا چه؟ | منطقی
آموزش کاربردی

پل ارتباطی Reasonable: تبدیل مدل‌های TLA+ به اثبات‌های ماشین‌خوان در Rust

پلتفرم Reasonable با ایجاد یک خط لوله عامل‌محور، مدل‌های انتزاعی TLA+ را به اثبات‌های Verus تبدیل می‌کند. این فناوری شکاف میان طراحی سیستم‌های توزیع‌شده و پیاده‌سازی کد Rust را از…

۹ دقیقه خواندن۱
پنج روش افزودن حافظه پایدار به عامل LangChain، از ساده تا پیچیده
آموزش کاربردی

۵ استراتژی برای پیاده‌سازی حافظهٔ پایدار در عامل‌های LangChain

بسیاری از آموزش‌های LangChain بر حافظهٔ موقت RAM تکیه می‌کنند که باعث فراموشی کامل عامل پس از هر بار ری‌استارت می‌شود. این راهنما ۵ روش ذخیره‌سازی داده‌ها، از دیکشنری‌های ساده تا…

۵ دقیقه خواندن۳
کنترل‌کننده‌های بدون سند برای عامل وجود ندارند.
آموزش کاربردی

رشته‌های توصیفیِ گمشده؛ دلیل پنهانِ نادیده گرفتنِ ابزارها توسط عامل‌های هوش

یک گزارش فنی فاش کرد که عامل‌های هوش مصنوعی ابزارهایی را که فاقد رشته‌های توصیفی (Description Strings) در مانیفست خود هستند، به‌طور کامل نادیده می‌گیرند. این «شکاف دیداری» باعث…

۴ دقیقه خواندن
واترز خواستار تحقیق درباره OpenAI و توقف موقت عرضه مدل‌های هوش مصنوعی شد

درخواست بازرسی کیفری از OpenAI به‌دلیل هدف قرار دادن وب‌سایت‌های دولتی آمریکا

نماینده کنگره آمریکا خواستار تحقیقات کیفری درباره OpenAI و توقف انتشار مدل‌های پیشرفته شد. این اقدام پس از گزارش‌هایی صورت گرفت که نشان می‌دهد عامل‌های هوش مصنوعی این شرکت…

۵ دقیقه خواندن
راهنمای جامع بند نرم‌افزاری Agent Harness: نصب، پیکربندی و بهینه‌سازی هوش مصنوعی
آموزش کاربردی

سیستم‌های مدیریت عامل؛ لایه‌ی حیاتی‌تر از هوش مدل در نرم‌افزارهای خودگردان

با تغییر رویکرد هوش مصنوعی از تکالیف کوتاه به گردش‌کارهای طولانی، «هارنس عامل» (Agent Harness) به عنوان سیستم مدیریت وضعیت و ایمنی، اهمیتی بیشتر از قدرت خام مدل‌های زبانی پیدا…

۲۳ دقیقه خواندن
قضاوت دو محور دارد. جِو یکی را فرو ریخت. تقریباً هیچ‌کس در محور دیگر نمی‌دود.

استدلال‌های قابل‌دفاع در برابر پاسخ‌های سریع در تصمیمات حساس AI

در حالی که مدل‌های جدیدی مانند Jev بر سرعت استثنایی و هزینه کم تمرکز دارند، شکافی عمیق در تصمیمات حساس و غیرقابل‌بازگشت وجود دارد. ظهور «داوران کند» مانند Decider نشان‌دهنده چرخش…

۷ دقیقه خواندن۱
اثبات ارتقای مدل با CSS و موتور اسکریپت غیرفعال
آموزش کاربردی

انیمیشن‌های خالص CSS در برابر JS؛ محک سخت‌گیرانه برای هوش مصنوعی

ابزار جدید Cascade با اجبار مدل‌ها به ساخت انیمیشن‌های خالص CSS و حذف کامل جاوااسکریپت، یک محک سخت‌گیرانه برای سنجش توانایی واقعی کدنویسی ایجاد کرده است. این سامانه مقایسه‌های…

۷ دقیقه خواندن
تبدیل GLM-5.3-Flash به مدل سیستم یکی شبیه جِو
آموزش کاربردی

آیا خواندن Logprobs می‌تواند مدل‌های زبانی را به سرعت Jev برساند؟

پژوهشگران راهکاری برای تبدیل مدل‌های زبانی عمومی به مدل‌های تصمیم‌گیرنده با سرعت بسیار بالا یافته‌اند. این روش به‌جای تولید متن، توزیع احتمالات توکن‌ها را می‌خواند و در مدل…

۱۰ دقیقه خواندن۲
ربات انسان‌نمای HomeBody در حال تعامل با محیط خانگی و یادگیری فضای اطراف
آموزش کاربردی

سامانه HomeBody با دوقلوهای دیجیتال محیط‌های ناشناخته را پیمایش می‌کند

پژوهشگران استنفورد رباتی انسان‌نما توسعه داده‌اند که با ساخت دوقلوهای دیجیتال از محیط‌های جدید، کارهای پیچیده خانگی را بدون اسکریپت‌های پیش‌نویس اجرا می‌کند. این سیستم با ترکیب…

۸ دقیقه خواندن۲