پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۷۶ مقاله منتشر شده

بررسی دسترسی‌ها در Ory Kratos با کمک هوش مصنوعی
آموزش کاربردی

رویکرد «میز قتل»؛ چرا هوش مصنوعی در شکار باگ‌های امنیتی شکست می‌خورد؟

مطالعه موردی روی Ory Kratos نشان می‌دهد که هوش مصنوعی در تولید فرضیات امنیتی موفق است اما در شناسایی باگ‌های واقعی ناتوان است. راهکار جایگزین، استفاده از AI برای ایجاد حدس‌های…

۸ دقیقه خواندن۱
مدار عصبی که امکان تفکر و بینایی را برای مغز فراهم می‌کند.

مدار «بازداری-بر-بازداری»؛ سازوکار مغز برای تغییر انعطاف‌پذیر بین وظایف

پژوهشگران دانشگاه کلمبیا مداری عصبی کشف کردند که به مغز اجازه می‌دهد به‌سرعت بین کارهای مختلف جابه‌جا شود. این یافته نشان می‌دهد نورون‌های بازدارنده که خودِ نورون‌های بازدارنده…

۵ دقیقه خواندن۲
Leanstral 1.5: فراوانی اثبات برای همه
آموزش کاربردی

مدل Leanstral 1.5 با مقیاس‌بندی زمان استنتاج ۵۸۷ مسئله ریاضی PutnamBench را حل

شرکت Mistral مدل وزن‌باز Leanstral 1.5 را برای تخصص در اثبات‌های ریاضی و تأیید رسمی کد معرفی کرد. این مدل با بهره‌گیری از یک گردش‌کار عامل‌محور، رکوردهای جدیدی در سطح دکترا ثبت…

۵ دقیقه خواندن۲
یادگیری بازنمایی پراکنده فدرال برای نگهداری ربات‌های نرم زیست‌محور با محدودیت‌های سیاستی بلادرنگ
آموزش کاربردی

چگونه یادگیری فدرال پراکنده دقت پیش‌بینی خرابی ربات‌ها را به ۹۴٪ رساند؟

یک چارچوب جدید با ترکیب یادگیری بازنمایی پراکنده و یادگیری فدرال، پیش‌بینی دقیق خرابی در ربات‌های نرم را ممکن کرد. این سامانه با محلی نگاه داشتن داده‌ها، نرخ دقت ۹۴ درصدی را با…

۹ دقیقه خواندن۱
عامل کدنویسی شما یک سطح حمله جدید است و اکثر توسعه‌دهندگان آماده نیستند
آموزش کاربردی

عامل‌های کدنویسی در برابر چت‌بات‌ها؛ چرا سطح حمله در اولی گسترده‌تر است

یک تجربه نزدیک به فاجعه در مواجهه با حمله تزریق پرامپت، شکاف امنیتی خطرناکی را در عامل‌های کدنویسی خودگردان آشکار کرد. برخلاف چت‌بات‌ها، این عامل‌ها به دلیل دسترسی به سیستم فایل و…

۴ دقیقه خواندن۲
شکست بازخوانی‌های چارچوب در جلوگیری از فرار مالی عامل هوش مصنوعی
آموزش کاربردی

معماری لایه‌ی دروازه؛ راهکار جلوگیری از تخلیهٔ سریع بودجه در عامل‌های هوش مصنوعی

ناپایداری در کنترل هزینه‌های ابزارهای عامل‌محور می‌تواند منجر به «حملات منع سرویس مالی» شود. تحلیل‌های جدید پیشنهاد می‌کنند سد بودجه از لایهٔ اجرا به لایهٔ دروازه (Gateway) منتقل…

۳ دقیقه خواندن
بررسی دقیق فراخوانی کند یا پرهزینه مدل زبانی بزرگ از دید توسعه‌دهنده
آموزش کاربردی

پایش توکن‌ها؛ راهکار جدید برای مهار هزینه‌های پنهان در استنتاج مدل‌ها

معیارهای سنتی پایش عملکرد دیگر برای عیب‌یابی مدل‌های زبانی کافی نیستند. ردیابی دقیق تعداد توکن‌ها و تأخیر ایجاد شده توسط حفاظ‌های امنیتی، تنها راه جلوگیری از جهش ناگهانی هزینه‌های…

۳ دقیقه خواندن
کاهش مصرف توکن Fable 5 با رندر کردن متن به‌صورت تصویر
آموزش کاربردی

«جایگزینی متن با تصویر»؛ راهبرد pxpipe برای بهینه‌سازی توکن‌ها

پراکسی محلی جدیدی به نام pxpipe با تبدیل متون حجیم به تصاویر، هزینه‌های ورودی مدل‌های Claude را به‌شدت کاهش می‌دهد. این روش از هزینه ثابت توکن‌های تصویری برای انتقال حجم زیادی از…

۱۰ دقیقه خواندن۲
عنوان مقاله: «عامل‌گرایی: حفظ رونوشت جلسات مفید نیست»

چرا دسترسی به متن جلسات پیشین عملکرد عامل‌های کدنویسی را تخریب می‌کند؟

تحلیلی از Agentics نشان می‌دهد که فراهم کردن دسترسی به متن جلسات پیشین (Session Transcripts)، هیچ اثر مثبتی بر عملکرد عامل‌های کدنویسی ندارد. این رویکرد به دلیل ایجاد «انحراف در…

۴ دقیقه خواندن۲