پرش به محتوای اصلی

موضوع

بازیابی‌افزا

RAG architectures, vector stores, grounding LLMs in private data

۱٬۱۱۲ مقاله منتشر شده

سیستم رتبه‌بندی نامزدها با یادگیری ماشین در سطح تولید: معماری، چالش‌ها و راه‌حل‌های عملی
آموزش کاربردی

درون سازوکار رتبه‌بندی متمرکز بر Production برای شناسایی مهندسان ارشد

یک مهندس نرم‌افزار با جایگزینی جست‌وجوی ساده‌ی کلیدواژه‌ای با یک سیستم رتبه‌بندی ترکیبی (Ensemble)، توانست از میان ۱۰۰ هزار پروفایل، برترین مهندسان یادگیری ماشین را شناسایی کند.…

۹ دقیقه خواندن۱
مشکل مسیریابی RAG: دانستن اینکه به کدام منبع دانش اعتماد کنیم
آموزش کاربردی

شباهت معنایی به‌تنهایی برای RAG کافی نیست؛ روتینگ راهکار جایگزین است

بسیاری از سیستم‌های RAG به دلیل اعتماد یکسان به تمام اسناد بازیابی‌شده شکست می‌خورند. برای حل این مشکل، نیاز به یک لایه مسیریابی (Routing) است که اعتبار منبع، تازگی داده و…

۱۵ دقیقه خواندن۲
لوگوی استارتاپ یونو و عنوان خبر جذب سرمایه ۲۳ میلیون دلاری سری A

استارت‌آپ Euno با جذب ۲۳ میلیون دلار لایه‌ی زمینه‌ساز داده‌های سازمانی را

شرکت Euno برای حل مشکل «تنگنای زمینه» در هوش مصنوعی سازمانی، ۲۳ میلیون دلار سرمایه جذب کرد. این پلتفرم با ایجاد یک نقشه‌ی ماشین‌خوان از دانش سازمان، مانع از حدس‌زدن عامل‌های هوش…

۵ دقیقه خواندن
هوش مصنوعی صدا: واقعیت در برابر آرزوهای دور از دسترس

«مقیاس به‌تنهایی کافی نیست»؛ تغییر اولویت‌ها در توسعه هوش مصنوعی صوتی

متخصصان صنعت هشدار می‌دهند که افزایش مقیاس مدل‌ها لزوماً منجر به انسانی‌تر شدن عامل‌های صوتی نمی‌شود. در این حوزه، تأخیر (Latency) و مبنی‌سازی (Grounding) جایگزین تعداد پارامترها…

۵ دقیقه خواندن۱
نمودار مقایسه مدل‌های زبانی چینی: دیپ‌سیک، کوئن، کیمی و مینی‌مکس در سال ۲۰۲۶
آموزش کاربردی

مدل DeepSeek V4 Flash هزینه استنتاج را ۹۶٪ نسبت به Sol کاهش داد

تحلیل جدید هزینه‌های API نشان می‌دهد که بخش بزرگی از صورت‌حساب‌های مدل‌های زبانی به دلیل تنظیمات پیش‌فرض اشتباه است، نه رشد مصرف. با جایگزینی مدل‌های پرچم‌دار با گزینه‌های اقتصادی…

۸ دقیقه خواندن۲
کنترل‌های ضروری مدل زبانی بزرگ در حاکمیت داده سلامت
آموزش کاربردی

۵ کنترل فنی برای جلوگیری از نشت داده‌های پزشکی در مدل‌های زبانی

ارائه‌دهندگان خدمات درمانی برای حفظ حاکمیت داده‌ها و رعایت استانداردهای HIPAA، استنتاج مدل‌های زبانی را به محیط‌های درون‌سازمانی منتقل می‌کنند. چارچوب جدیدی پنج کنترل فنی حیاتی را…

۴ دقیقه خواندن۱
بررسی robots.txt در ۵۰۰۰ سایت برتر: ۲۳۸ سایت به اشتباه استنادهای ChatGPT را مسدود کرده‌اند.

گوگل در برابر ChatGPT Search؛ تفاوتِ دیده‌شدن در موتورهای جست‌وجو

بررسی فنی ۵۰۰۰ وب‌سایت برتر نشان می‌دهد صدها دامنه به‌دلیل اشتباه در پیکربندی، دسترسی خزنده‌های جست‌وجوی هوش مصنوعی را مسدود کرده‌اند. این خطا باعث می‌شود این سایت‌ها در پاسخ‌های…

۳ دقیقه خواندن۱
لوگوی مروری ۲.۵ با عنوان «آغاز»، نمادی از شروع دوره جدیدی در توسعه هوش مصنوعی.

مدل Mercury 2.5 هوش مصنوعی را ۴۰٪ ارتقا داد اما تأخیر را ثابت نگه داشت

شرکت Inception مدل Mercury 2.5 را به‌عنوان بزرگ‌ترین مدل زبانی مبتنی بر انتشار معرفی کرد که ۴۰٪ هوشمندتر از نسل قبل است. این مدل با توان عملیاتی ۱۱۰۷ توکن در ثانیه، برای کاربردهای…

۴ دقیقه خواندن۳
تبدیل ۲۰۰۰ گفتگوی مشتری به داده قابل جستجو در چند ساعت
آموزش کاربردی

«تفکیک ارزیابی‌های گران‌قیمت»؛ راهکار جدید برای تحلیل داده‌های حجیم

یک معماری جدید با تفکیک ارزیابی‌های گران‌قیمت مدل زبانی از پرس‌وجوهای سریع، تحلیل هزاران مکالمه مشتری را ممکن کرده است. این سیستم با نرمال‌سازی داده‌ها پیش از استنتاج، همسویی…

۳ دقیقه خواندن۱