پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۹ مقاله منتشر شده

لوگوی مجله PMB
آموزش کاربردیگزارش تأییدنشده

«حافظه محلی»؛ استراتژی PMB برای حذف وابستگی مدل‌های هوش مصنوعی به ابر

پروژه متن‌باز PMB با انتقال حافظه مدل‌های هوش مصنوعی از ابر به دستگاه کاربر، تأخیر را کاهش و حریم خصوصی را افزایش داده است. این معماری امکان اجرای مدل‌ها به‌صورت آفلاین و دسترسی…

۳ دقیقه خواندن
برنامه‌ریزی عصبی-نمادین تطبیقی برای شبکه‌های لجستیک تخلیه آتش‌سوزی جنگل با تضمین‌های حاکمیت عدم اعتماد صفر
آموزش کاربردی

«حاکمیت اعتماد صفر»؛ تضمین ایمنی عملیات در مدیریت بحران‌های محیطی

یک سیستم جدید با ترکیب شبکه‌های عصبی و استدلال نمادین، مدیریت تخلیه مناطق دچار آتش‌سوزی را بهینه‌تر کرده است. این معماری با حذف خطاهای بحرانی در سناریوهای پیش‌بینی‌نشده و…

۸ دقیقه خواندن۲
ابزارک عامل بیونمو انویدیا: تبدیل مدل‌های زیست‌مولکولی به مهارت‌های قابل فراخوانی برای عامل‌های هوش مصنوعی در کشف دارو
آموزش کاربردی

چگونه ابزار متن‌باز انویدیا نرخ خطای مدل‌های زیست‌مولکولی را حذف کرد؟

انویدیا ابزاری متن‌باز برای تبدیل مدل‌های زیست‌مولکولی به «مهارت‌های» مستند عرضه کرد. این رویکرد با جایگزینی پرامپت‌های عمومی با مهارت‌های تخصصی، نرخ تکمیل وظایف پیچیده در کشف…

۵ دقیقه خواندن۳
عامل خرد: غلبه بر مدل‌های مرزی با همکاری درون API مدل
آموزش کاربردی

vLLM با مسیریاب معنایی، عملکرد مدل‌های پیشرو را در بنچمارک‌های سخت شکست داد

پلتفرم vLLM با معرفی مسیریاب معنایی (Semantic Router)، یک فراخوان API واحد را به تیمی از ریز-عامل‌ها تبدیل می‌کند. این رویکرد با جایگزینی انتخاب مدل با «ساخت قابلیت»، در آزمون‌های…

۹ دقیقه خواندن۱
حلقه‌ای طراحی کردم که خودش عامل کدنویسی را هدایت می‌کند. دیگر پرامپت نمی‌نویسم.
آموزش کاربردی

LoopFlow با حلقه‌های تأیید چندعاملی جایگزین مهندسی پرامپت در کدنویسی شد

ابزار متن‌باز LoopFlow با جایگزینی پرامپت‌های دستی با حلقه‌های خودکار، فرآیند کدنویسی AI را متحول می‌کند. این سامانه از یک «عامل دروازه‌بان» برای بازبینی کد استفاده می‌کند تا از…

۳ دقیقه خواندن
نرخ موفقیت عامل‌تان فقط بازماندگان را می‌شمارد
آموزش کاربردی

مالیات بقا؛ چرا داشبورد‌های عامل‌های هوش مصنوعی نرخ موفقیت را جعل می‌کنند؟

یک نقص رایج در تحلیل داده‌های عامل‌های هوش مصنوعی با نادیده گرفتن اجراهای متوقف شده یا «معلق»، نرخ موفقیت را به‌طور مصنوعی بالا می‌برد. تغییر مخرج کسر از «اجراهای تمام‌شده» به…

۱۳ دقیقه خواندن
تأیید خروجی مدل زبانی بزرگ: تشخیص توهم و حمله تزریق در محیط عملیاتی
آموزش کاربردی

اعتبارسنجی خروجی؛ سد دفاعی جدید در برابر توهم و تزریق پرامپت

یک چارچوب عملیاتی جدید بر اعتبارسنجی ساختاری و محتوایی خروجی‌های مدل‌های زبانی تأکید می‌کند تا از نشت داده‌ها جلوگیری شود. در این روش، پاسخ‌های معیوب به‌جای اصلاح، به‌طور کامل رد…

۱ دقیقه خواندن
مهندسان آمازون در حال تقطیر مدل‌های Anthropic برای کاهش هزینه قبل از اجرای قیمت‌گذاری جدید بر اساس توکن هستند.

درون برنامهٔ آمازون برای تقطیر مدل‌های Anthropic جهت کاهش هزینه‌ها

مهندسان آمازون برای پیش‌دستی در برابر تغییر مدل قیمت‌گذاری توکنی، در حال ساخت نسخه‌های کوچک‌تر و ارزان‌تر از مدل‌های Claude هستند. این اقدام برای کاهش وابستگی به API‌های گران‌قیمت…

۱ دقیقه خواندن