پرش به محتوای اصلی

موضوع

بازیابی‌افزا

RAG architectures, vector stores, grounding LLMs in private data

۱٬۲۰۹ مقاله منتشر شده

عامل هوش مصنوعی که با نمایش شواهد، آسیب‌پذیری‌های امنیتی را برای شما تحلیل می‌کند

عامل امنیتی جدید با اولویت‌دهی به شواهد نرخ توهم در تحلیل npm را کاهش داد

یک دستیار امنیتی جدید با ترکیب داده‌های OSV.dev و پایگاه دانش Sanity، آسیب‌پذیری‌های بسته‌های npm را بررسی می‌کند. این ابزار برخلاف چت‌بات‌های معمولی، با ارائه مسیر شواهد…

۵ دقیقه خواندن۳
محدودیت فعلی AWS کدام است؟ عاملی که آن را ثابت می‌کند: ۳۲ در برابر ۵ در برابر ۱۶

داده‌های ساختاریافته جایگزین مدل‌های هوشمند برای حل مشکل «انحراف سهمیه» در AWS

یک عامل هوش مصنوعی جدید ثابت کرد که برای رفع تناقضات در مستندات ابری، داده‌های ساختاریافته مؤثرتر از مدل‌های زبانی پیشرفته‌تر هستند. این سیستم با تطبیق حقایق تایپ‌شده و بررسی‌های…

۸ دقیقه خواندن۱
مقایسه مدل Embed 5 شرکت Cohere با Voyage 4 Large، Gemini Embedding 2 و OpenAI

مدل Fast کوهیر چگونه تأخیر در عامل‌های هوش مصنوعی را کاهش می‌دهد؟

شرکت کوهیر خانواده مدل‌های بردار معنایی Embed 5 را با دو سطح Pro و Fast معرفی کرد که از یک فضای برداری مشترک استفاده می‌کنند. مدل Pro در بازیابی داده‌های مالی رکورد جدیدی ثبت کرده…

۶ دقیقه خواندن
نسخه ۲.۵ ابزار استخراج LlamaIndex با دقت و پایه‌گذاری بهتر منتشر شد

نسخه ۲.۵ LlamaIndex استخراج داده‌های پیچیده را ارزان‌تر و دقیق‌تر کرد

آپدیت جدید LlamaIndex با معرفی «استدلال ساختاری»، دقت استخراج داده از اسناد سازمانی را بدون افزایش هزینه افزایش داده است. این نسخه اکنون در لایه‌ی اقتصادی، عملکرد لایه‌های…

۵ دقیقه خواندن
پرامپت سیستم توصیف نیست — قرارداد است

پژوهش جدید: محدودیت‌های سخت در پرامپت‌ها نرخ توهم مدل‌ها را کاهش می‌دهد

دستورات مبهم در پرامپت‌های سیستمی باعث رفتارهای پیش‌بینی‌ناپذیر مدل‌ها می‌شوند. با تبدیل این دستورات به «قراردادهای رفتاری» با محدودیت‌های سخت و فرمت‌های خروجی دقیق، می‌توان نرخ…

۸ دقیقه خواندن
هزینه ساخت یک عامل هوش مصنوعی در سال ۲۰۲۷ چقدر است؟

هزینهٔ استقرار عامل‌های هوش مصنوعی در سال ۲۰۲۷ تا ۲۰۰ هزار دلار می‌رسد

برآوردها نشان می‌دهد ساخت عامل‌های هوش مصنوعی در سطح سازمانی تا سال ۲۰۲۷ بودجه‌ای بین ۱۵ تا ۲۰۰ هزار دلار می‌طلبد. بخش اعظم این هزینه‌ها نه مربوط به مدل‌ها، بلکه متعلق به مهندسی…

۷ دقیقه خواندن
سه باگ پنهان در چارچوب عامل هوش مصنوعی متن‌باز

سه خطای خاموش در چارچوب OGX نتایج جست‌وجوی عامل‌های AI را مخدوش کرد

یک بازرسی فنی در چارچوب متن‌باز OGX سه باگ بحرانی را شناسایی کرد که بدون ایجاد خطا، نتایج بازیابی اطلاعات و محاسبه هزینه‌ها را تغییر می‌دهند. این نقص‌ها باعث تزریق داده‌های قدیمی…

۳ دقیقه خواندن
API من هیچ‌وقت توکن‌ها را امضا نمی‌کند و رمزهای عبور را نمی‌بیند

«تأیید به‌جای صدور»؛ استراتژی جدید برای ایمن‌سازی APIهای بازیابی اطلاعات

یک الگوی معماری جدید پیشنهاد می‌کند که APIهای سرویس‌های RAG باید به‌جای صدور توکن، تنها نقش تأییدکننده را ایفا کنند. با سپردن صدور توکن به سرویس‌های تخصصی مانند Keycloak، خطر سرقت…

۵ دقیقه خواندن