
افشای تدریجی در Ratel چگونه نیاز به حافظههای برداری را حذف میکند؟
لایه مهندسی زمینه Ratel با استفاده از مکانیزم «افشای تدریجی»، بار توکنهای ورودی را ۸۰٪ کاهش میدهد. این ابزار با تزریق ابزارهای مورد نیاز در لحظه، نیاز به پایگاهدادههای برداری…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۵ مقاله منتشر شده

لایه مهندسی زمینه Ratel با استفاده از مکانیزم «افشای تدریجی»، بار توکنهای ورودی را ۸۰٪ کاهش میدهد. این ابزار با تزریق ابزارهای مورد نیاز در لحظه، نیاز به پایگاهدادههای برداری…

مقیاسدهی ناکارآمد مدلهای هوش مصنوعی زاینده باعث جهش قیمت حافظه و سختافزار در سطح جهان شده است. کارشناسان هشدار میدهند که تقاضای شدید منابع ممکن است تا سال ۲۰۲۸ رایانههای…

پلاگین متنباز agent-talk امکان تبادل پیام مستقیم بین عاملهای هوش مصنوعی در جلسات و دستگاههای مختلف را فراهم میکند. این ابزار با حذف نیاز به کپی-پیست دستی دستورات توسط…

مهندسان گوگل برای رفع شکستهای مقیاسپذیری در عاملهای هوش مصنوعی، روشی برای تبدیل پرامپتها از متنهای ایستا به آثار تدوینشده (Build Artifacts) پیشنهاد دادهاند. این رویکرد با…

گوگل کلاود با عرضه مجموعهای از مدلهای تخصصی برای زیستشناسی، علم مواد و اقلیم در Vertex AI، از رویکرد مدلهای همهمنظوره فاصله گرفت. هدف این اقدام فراهم کردن نتایج علمی قابل…

بانکهای پیشرو از استراتژی مدل واحد فاصله گرفته و به معماری لایهای روی آوردهاند که در آن مدلهای زبانی کوچک (SLM) بخش اعظم وظایف را برعهده دارند. این چرخش، هزینههای استنتاج را…

یک باگ بحرانی در پردازش دستهای n8n باعث میشد تاریخچه گفتگوهای کاربران مختلف با یکدیگر ترکیب شود. این مشکل که منجر به تخریب خاموش دادهها میشد، از طریق سیستم برچسبگذاری و فیلتر…

ابزار تخصصی GAUNTLEX الزامات قانونی HIPAA و FINRA را به تستهای کد قابل اجرا تبدیل میکند. این سامانه با مسدود کردن ادغام کدهای متخلف، بازرسیهای دستی فصلانه را با نظارت لحظهای…

انویدیا مجموعهای از مدلهای بردار معنایی با وزنهای باز را برای کاهش هزینههای توکن و افزایش دقت در گردشکارهای عاملمحور منتشر کرد. مدل پرچمدار ۸ میلیاردی این مجموعه در حال…

استارتاپ جدید میرا موراتی مدل ۹۷۵ میلیارد پارامتری Inkling را منتشر کرد که در کارهای agentic از رقبای آمریکایی پیشی گرفته است. این مدل علیرغم برتری در وظایف عملیاتی، همچنان در دقت…

گوگل با معرفی مدل آزمایشی DiffusionGemma، گلوگاه حافظه در تولید متن را به توان محاسباتی منتقل کرد. این معماری با پردازش موازی بلوکهای متنی، سرعت استنتاج را بهشدت افزایش داده و…

لاگهای فعلی عاملهای هوش مصنوعی در صورت تغییر دادههای منبع، قادر به بازسازی دلیل تصمیمات گذشته نیستند. Lians با تفکیک زمان رویداد، زمان اعتبار و زمان سیستم، معماری جدیدی برای…