پرش به محتوای اصلی

موضوع

بازیابی‌افزا

RAG architectures, vector stores, grounding LLMs in private data

۱٬۲۰۹ مقاله منتشر شده

عامل سحابی: هوش مصنوعی که تناقضات در محتوای ساختاریافته را آشکار می‌کند
آموزش کاربردی

عامل Nebula با داده‌های ساختاریافته توهمات هوش مصنوعی را شناسایی می‌کند

یک عامل هوش مصنوعی جدید با استفاده از دریاچه محتوای Sanity، تضادهای میان کتابچه‌های قانون و اصلاحیه‌ها را شناسایی می‌کند. این سیستم به‌جای جست‌وجوی کلمات کلیدی، از کوئری‌های GROQ…

۵ دقیقه خواندن۳
روزنامه استیان: نشریه شایعه‌پراکنی مستعمره ریم‌ورلدم که باید فایل ذخیره را ذکر کند
سرگرمی و خلاقیت

ترکیب Claude Code و کدنویسی قطعی؛ راهکاری برای حذف توهم در گزارش‌های هوش مصنوعی

یک توسعه‌دهنده با استفاده از Claude Code سامانه «The Estian Tattler» را ساخت تا داده‌های بازی RimWorld را به اخبار زرد تبدیل کند. این سیستم برای حذف توهمات، از یک بررسی‌کنندهٔ…

۹ دقیقه خواندن
کوهیر نسخه بتا خصوصی Compass Cloud را برای جستجوی سازمانی مدیریت‌شده راه‌اندازی کرد.
اخبار کوتاه روزانه

Compass Cloud در برابر Azure Search؛ رقابتی برای بهینه‌سازی زیرساخت‌های RAG

شرکت Cohere پلتفرم Compass Cloud را برای ساده‌سازی زیرساخت‌های RAG در سازمان‌ها معرفی کرد. این سرویس با یکپارچه کردن مراحل پردازش داده، هزینه توکن‌ها و تأخیر در گردش‌های کاری…

۵ دقیقه خواندن۱
یادگیری ماشین کاربردی در طراحی محصولات سازمانی: از نمونه‌های اولیه تا تجربه‌های قابل اعتماد
آموزش کاربردی

سه رکن حیاتی برای تبدیل دموهای هوش مصنوعی به محصولات تجاری

دلون شوارتز، مهندس طراحی AI، چارچوبی برای خروج از «تئاتر مدل‌محور» و تبدیل نمونه‌های اولیه به محصولات قابل‌اتکا ارائه می‌دهد. این رویکرد بر همراستاسازی سیستم‌های یادگیری، طراحی…

۵ دقیقه خواندن
بررسی عملکرد ۸ مدل زبانی بزرگ در پاسخگویی به پیام‌های مشتریان فروشگاه‌های آنلاین اندونزیایی
آموزش کاربردی

مدل‌های زبانی کوچک در مواجهه با زبان عامیانه ۱۵٪ دقت خود را از دست می‌دهند

محک جدید UMKM-Bench نشان می‌دهد مدل‌های کوچک و وزن‌باز در درک پیام‌های مشتریان حاوی غلط املایی و اصطلاحات محلی به‌شدت ضعیف هستند. این مطالعه یک «شکاف صداقت» خطرناک را افشا می‌کند…

۸ دقیقه خواندن۱
زیرساخت محلی مدل زبانی بزرگ سلامت با حاکمیت داده
آموزش کاربردی

هوش مصنوعی حاکمیتی؛ راهکار جدید برای حفظ حریم خصوصی داده‌های پزشکی

سازمان‌های بهداشتی برای جلوگیری از نشت سوابق حساس بیماران، از زیرساخت‌های درون‌سازمانی برای اجرای مدل‌های زبانی بزرگ روی می‌آورند. این رویکرد با محلی کردن استنتاج، نیاز به ارسال…

۳ دقیقه خواندن۳
نمایش بصری جستجوی برداری: پرسش کاربر به بردار تبدیل شده و نزدیک‌ترین نتایج در فضای چندبعدی یافت می‌شوند.
آموزش کاربردی

اندیس‌های ANN تأخیر جست‌وجوی برداری را ۶۰ برابر کاهش دادند

الگوریتم‌های نزدیک‌ترین همسایه تقریبی (ANN) با پذیرش خطای اندک در دقت، سرعت بازیابی داده‌ها را به زیر میلی‌ثانیه می‌رسانند. این سازوکار اجازه می‌دهد سامانه‌های RAG بدون افت…

۱۱ دقیقه خواندن۲
چت‌بات‌های هوشمند اخلاقی: کاهش هزینه کسب‌وکارهای کوچک و متوسط
آموزش کاربردی

کاهش هزینه‌های پشتیبانی کسب‌وکارهای کوچک با حاکمیت اخلاقی چت‌بات‌ها

کسب‌وکارهای کوچک و متوسط می‌توانند با استقرار چت‌بات‌های محدود و تحت نظارت که اولویت را به شفافیت و ارجاع به انسان می‌دهند، هزینه‌های عملیاتی خود را کاهش دهند. کلید موفقیت در این…

۱۱ دقیقه خواندن۱
سیستم پشتیبانی تصمیم مبتنی بر مدل زبانی بزرگ در حال پردازش داده‌ها و تولید توصیه‌های هوشمند
آموزش کاربردی

Oxlo.ai هزینه سیستم‌های تصمیم‌یار را با مدل قیمت‌گذاری درخواستی کاهش داد

ساخت سیستم‌های تصمیم‌یار در مقیاس صنعتی نیازمند عبور از مهندسی پرامپت و حرکت به سمت معماری‌های ساختاریافته است. Oxlo.ai برای رفع گلوگاه هزینه‌های توکن در گردش‌کارهای عامل‌محور،…

۳ دقیقه خواندن
مقایسه سه روش پردازش متن طولانی: کانتکست بلند، RAG و تنظیم دقیق مدل
آموزش کاربردی

۳ راهکار بهینه‌سازی مدل‌های زبانی برای کاهش هزینه‌های عملیاتی

انتخاب اشتباه تکنیک بهینه‌سازی هوش مصنوعی منجر به افزایش هزینه‌ها بدون رفع نقص‌های عملکردی می‌شود. این راهنما مرز عملیاتی بین استفاده از پنجره متنی برای داده‌های موقت، RAG برای…

۱۲ دقیقه خواندن۱