پرش به محتوای اصلی

موضوع

بازیابی‌افزا

RAG architectures, vector stores, grounding LLMs in private data

۱٬۱۱۲ مقاله منتشر شده

کیوئن ۳.۵ با وجود استدلال مشابه جی‌ال‌ام-۵.۲، ۸۲ درصد واقعیت‌ها را توهم می‌زند

چرا مدل‌های پیشرو در ریاضیات همچنان دچار توهمات گسترده می‌شوند؟

تحلیل‌های فنی جدید نشان می‌دهد آزمایشگاه‌های AI برای افزایش کارایی استدلال، عمداً دانش فکت‌محور را از مدل‌ها حذف می‌کنند. مدل‌هایی مانند Qwen3.5 در ریاضیات پیشرو هستند اما در نبود…

۱۲ دقیقه خواندن
مدل‌های هوش مصنوعی عمداً کم‌هوش‌تر می‌شوند

درون استراتژی جدید حذف داده‌های فکت‌محور برای ساخت مدل‌های کوچک‌تر

روند جدید توسعه مدل‌ها نشان می‌دهد که آزمایشگاه‌ها برای اولویت دادن به توانایی استدلال، عمداً دانش факти (factual) را از وزن‌های مدل حذف می‌کنند. این جداسازی اجازه می‌دهد مدل‌های…

۶ دقیقه خواندن
ساخت خط لوله RAG با داده‌های وب زنده
آموزش کاربردی

«تبدیل مدل‌های ایستا به عامل‌های هوشمند»؛ راهکار جدید Alterlab

استفاده از داده‌های زنده وب در خط لوله‌های RAG به مدل‌های زبانی اجازه می‌دهد محدودیت تاریخ آموزش را دور بزنند. با ترکیب استخراج دقیق و پاک‌سازی متن، می‌توان مدل‌های ایستا را به…

۳ دقیقه خواندن۱
پشتیبانی هوشمند: پاسخ‌های ساخت‌یافته JSON، جستجوی معنایی، استناددهی و مدیریت هزینه‌های مشتریان
آموزش کاربردی

درون معماری جدید تریاژ؛ استفاده از گیت‌های JSON برای کنترل خروجی

یک الگوی معماری جدید برای تریاژ پشتیبانی، با استفاده از طرح‌واره‌های سخت‌گیرانه JSON و لیست‌های مجاز استناد، توهمات مدل را از بین می‌برد. این روش با جداسازی بازیابی از سنتز، امکان…

۷ دقیقه خواندن۳
تکنیک‌های بهینه‌سازی عملکرد مدل‌های زبانی بزرگ
آموزش کاربردی

مدل قیمت‌گذاری Oxlo.ai هزینه استنتاج را از تعداد توکن‌ها جدا کرد

استراتژی‌های جدید بهینه‌سازی، تمرکز را از کوتاه کردن اجباری پرامپت‌ها به سمت افزایش دقت از طریق قیمت‌گذاری ثابت تغییر داده‌اند. توسعه‌دهندگان اکنون می‌توانند بدون ترس از افزایش…

۲ دقیقه خواندن۱
راه‌حل ZIM برای رفع توهمات کد در بوم دوبعدی
آموزش کاربردی

درون سیستم ZIM برای تبدیل کدهای توهمی به استانداردهای برنامه‌نویسی

تیم ZIM با ارائه یک «پرامپت جامع» و نقشه‌های API بهینه‌شده، مانع از استفاده مدل‌های زبانی از الگوهای کدنویسی قدیمی شد. این سیستم توهمات رایج را با کدهای استاندارد و بهینه جایگزین…

۴ دقیقه خواندن۱
بخش روابط عمومی اسرائیل می‌خواهد به سؤالات چت‌جی‌پی‌تی شما پاسخ دهد

اسرائیل برای تغییر پاسخ‌های ChatGPT و Perplexity عملیات سازمان‌یافته آغاز کرد

اسرائیل از طریق یک سازمان پوششی به نام مؤسسه هانوور، کمپینی راهبردی برای تزریق روایت‌های مثبت به مدل‌های زبانی بزرگ آغاز کرده است. اسناد افشا شده نشان می‌دهد این عملیات با هدف…

۷ دقیقه خواندن۳
کوانتایز کردن مدل تعبیه: چه کیفیتی واقعاً از دست می‌دهید
آموزش کاربردی

آیا می‌توان حافظهٔ ایندکس‌های برداری را بدون افت کیفیت کاهش داد؟

استفاده از کوانتش باینری می‌تواند فضای ذخیره‌سازی ایندکس‌های برداری را تا ۳۲ برابر کاهش دهد و ۹۶٪ از کیفیت بازیابی را حفظ کند. موفقیت این روش به شدت به پیاده‌سازی صحیح…

۵ دقیقه خواندن۱