
OpenHuman: کاهش ۸۰ درصدی هزینههای LLM با لایهی فشردهسازی TokenJuice
OpenHuman یک عامل هوش مصنوعی متنباز و محلی است که با استفاده از «درخت حافظه» و لایهی فشردهسازی، هزینههای API را تا ۸۰٪ کاهش میدهد. این ابزار با اولویت دادن به حریم خصوصی،…
موضوع
RAG architectures, vector stores, grounding LLMs in private data
۶۹۵ مقاله منتشر شده

OpenHuman یک عامل هوش مصنوعی متنباز و محلی است که با استفاده از «درخت حافظه» و لایهی فشردهسازی، هزینههای API را تا ۸۰٪ کاهش میدهد. این ابزار با اولویت دادن به حریم خصوصی،…

عاملهای هوش مصنوعی اغلب کدهای SQL صحیحی مینویسند که از نظر منطق تجاری غلط هستند. برای حل این مشکل، توسعهدهندگان باید بهجای تکیه بر پرامپتهای شکننده، از «نماهای تأییدشده»…

پژوهش جدید Pi-Serini نشان میدهد که ترکیب بازیابی لغتمحور (BM25) با مدلهای پیشرو مانند GPT-5.5 در وظایف پژوهشی عمیق، عملکرد بهتری نسبت به سیستمهای جستجوی متراکم دارد. این سیستم…

لنگچین با معرفی Context Hub در پلتفرم LangSmith، مدیریت دستورالعملها و سیاستهای عاملها را از کد برنامهنویسی جدا کرد. این ابزار به تیمها اجازه میدهد بدون نیاز به استقرار…

توسعهگران همراهان هوش مصنوعی با جایگزینی APIهای تکمدلی با درگاههای یکپارچه، هزینههای استنتاج را تا ۴۰٪ کاهش دادهاند. این رویکرد اجازه میدهد شخصیتهای دیجیتال از وابستگی به…

تیمهای SRE در حال گذار از تحلیل سادهی هشدارها به «بررسی عاملمحور» هستند؛ سیستمی که در آن هوش مصنوعی برای یافتن علت ریشهای خطا، مستقیماً ابزارهای زیرساختی را اجرا میکند. این…

پژوهشی جدید نشان میدهد گوگل سرچ، AI Overviews و Gemini به عنوان سه سیستم اطلاعاتی مجزا با منطقهای رتبهبندی متفاوت عمل میکنند. این ابزارها بهندرت بر سر منابع مورد استناد توافق…

یک خطلوله جدید تولید بازیابیافزا (RAG) با استفاده از مدلهای Qwen3 توانست به دقت ۹۵.۹۸ درصدی در درک اسناد چنددامنه اوکراینی دست یابد. این سیستم ثابت میکند که بازرتببندی آگاه…

پژوهشگران چارچوب M³Att را معرفی کردند که با استفاده از محرکهای بصری و اطلاعات گمراهکننده، سیستمهای RAG پزشکی را هدف قرار میدهد. این حمله مدلها را فریب میدهد تا تشخیصهای…

یک بنچمارک جدید نشان میدهد که پیشرفتهترین مدلهای زبانی در بازیابی دقیق استنادات حقوقی بدون دسترسی به منابع خارجی شکست میخورند. این مطالعه ثابت میکند که مقیاس مدل و پیشآموزش…

برگ برنده در هوش مصنوعی سازمانی دیگر مدل نیست، بلکه معماری پیرامونی آن است. پلتفرم SuperML.dev لایههای حیاتی مانند قراردادهای معنایی و صفحات کنترل عامل را برای عبور از مرحلهی…

پژوهشی جدید نشان میدهد انتخاب نمونههای Few-shot بر اساس برچسبهای متنی، بسیار پایدارتر از شباهت کسینوسی در تولید گزارشهای حوادث پزشکی است. این روش در مدلهای GPT-4o و LLaMA 3.3…