
سقوط دقت بازیابی در pgvector؛ مرز ۱۰ هزار بردار برای سامانههای RAG
یک سامانه تولید بازیابیافزا (RAG) در محیط عملیاتی، پس از رسیدن به ۱۰ هزار بردار، شاهد افت شدید دقت از ۰.۸۵ به ۰.۵۵ بود. این شکست فنی که ناشی از محدودیتهای ایندکس IVFFlat بود، با…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۰۸ مقاله منتشر شده

یک سامانه تولید بازیابیافزا (RAG) در محیط عملیاتی، پس از رسیدن به ۱۰ هزار بردار، شاهد افت شدید دقت از ۰.۸۵ به ۰.۵۵ بود. این شکست فنی که ناشی از محدودیتهای ایندکس IVFFlat بود، با…

تیمی از پیشگامان گوگل AI در حال ساخت سامانهای هستند که فراتر از تولید کد، کل چرخه پژوهش علمی شامل فرضیهسازی، اجرا و تحلیل را خودکار میکند. این زیرساخت با هدف شتاببخشی به…

آمازون ابزار AWS Quick را مستقیماً در ورد، اکسل، پاورپوینت و اوتلوک ادغام کرد. این اقدام به کاربران سازمانی اجازه میدهد دادههای محیطهای AWS و ابزارهایی مثل Salesforce و Jira…

پروتکل Open Job Context (OJCP) زبانی مشترک برای یافتن و درخواست شغل توسط عاملهای هوش مصنوعی ایجاد میکند. این استاندارد که بر پایه MCP بنا شده، مسیرهای پراکنده درخواست شغل را با…

مدل V4 Pro شرکت DeepSeek با جهشی چشمگیر در بنچمارکهای کدنویسی و عاملمحور، از فاز آزمایشی به تولید کامل رسید. همزمان با این بهروزرسانی، این شرکت نرمافزار مدیریت عاملهای خود…

سامسونگ با استفاده از ابزار Claude Code سرعت تأیید طراحی نیمهرساناها را بهشدت افزایش داده است. با این حال، گزارشها از خطاهای بحرانی مانند تغییر غیرمجاز کدها و پنهان کردن…

پژوهشگران چینی با تبدیل مدل آفلاین Wan2.2-Animate به یک سامانه استریمینگ، مانع «تولید و انتظار» در ویدیوهای هوش مصنوعی را از بین بردند. این چارچوب با استفاده از حافظهٔ پوز-کش و…

گوگل با بازسازی بخش هوش مصنوعی خود، جف دین را از مقام دانشمند ارشد کنار گذاشت و دیمیس هاسابیس را به ریاست هیئتمدیره رساند. این چرخش راهبردی نشاندهنده تغییر تمرکز گوگل از تحقیقات…

بازنویسی توابع با هوش مصنوعی ریسک رگرسیونهای خاموش و افزایش حجم بازبینی کد را دوبرابر میکند. راهکار ایمنتر، استفاده از مدلها برای تولید ورودیهای لبهای (Edge Cases) است تا کد…

آنتروپیک در حال مذاکره برای خرید Decart AI است تا با دسترسی به فناوری بهینهسازی تراشهها و مدلهای شبیهساز جهان، هزینههای استنتاج را کاهش داده و زیرساخت آموزش رباتها را فراهم…

مدل جدید Ant Group با نام Ling 3.0 Flash در کلاس مدلهای کوچک، رقبای خود را از نظر هوش و هزینه شکست داد. این مدل نرخ توهم را بهشدت کاهش داده و در وظایف عاملمحور عملکرد بهتری…

شرکت Anthropic و Redwood Research شاخص استدلال مفهومی (CRI) را برای سنجش توانایی مدلها در تحلیل فلسفی و استدلالهای بدون داده مرجع معرفی کردند. نتایج نشان میدهد حتی پیشرفتهترین…