پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۲۵۴ مقاله منتشر شده

چگونه استریم لحظه‌ای مدل‌های زبانی را با کمتر از ۱۵۰ خط کد در Next.js بسازیم؟
آموزش کاربردی

چگونه استریم لحظه‌ای مدل‌های زبانی را با کمتر از ۱۵۰ خط کد در Next.js بسازیم؟

پیاده‌سازی Server-Sent Events (SSE) در Next.js اجازه می‌دهد مدل‌های زبانی محلی در Ollama، توکن‌ها را کلمه به کلمه ارسال کنند. این روش تأخیر در نمایش متن را می‌گیرد و تجربه کاربری…

۲ دقیقه خواندن
انتخاب مدل بردار معنایی؛ مرز میان دقت بازیابی و سقوط بودجه در RAG
آموزش کاربردی

انتخاب مدل بردار معنایی؛ مرز میان دقت بازیابی و سقوط بودجه در RAG

انتخاب درست مدل بردار معنایی و متریک شباهت، تعیین‌کننده دقت جست‌وجوی معنایی و سیستم‌های RAG است. این راهنما توازن میان ابعاد بردار و پیش‌پردازش داده‌ها برای بهینه‌سازی بازیابی را…

۲ دقیقه خواندن
سازوکار RAG: مهار توهمات هوش مصنوعی با بهینه‌سازی خط لوله داده
آموزش کاربردی

سازوکار RAG: مهار توهمات هوش مصنوعی با بهینه‌سازی خط لوله داده

تولید بازیابی‌افزا (RAG) با اتصال مدل‌های زبانی به داده‌های خصوصی و به‌روز، مشکل توهم و تاریخ انقضای دانش را حل می‌کند. در این معماری، تمرکز مهندسی از طراحی پرامپت به بهینه‌سازی…

۲ دقیقه خواندن
۳.۴۷ دلار هزینه API و ۴۷ ساعت صرفه‌جویی: سازوکار جدید اتوماسیون تیکت‌ها
آموزش کاربردی

۳.۴۷ دلار هزینه API و ۴۷ ساعت صرفه‌جویی: سازوکار جدید اتوماسیون تیکت‌ها

یک توسعه‌دهنده با استفاده از OpenRouter و Node.js سیستمی برای پردازش تیکت‌های مشتریان طراحی کرد که هزینه‌های API را ۶۸٪ کاهش داد. این معماری سبک توانست در سه هفته ۴۷ ساعت از زمان…

۲ دقیقه خواندن
AI
آموزش کاربردی

چگونه OpenJarvis هزینه استنتاج عامل‌های هوش مصنوعی را ۸۰۰ برابر کاهش داد؟

پلتفرم متن‌باز OpenJarvis از دانشگاه استنفورد و آزمایشگاه‌های Lambda، امکان اجرای عامل‌های هوش مصنوعی را به‌صورت کاملاً محلی فراهم می‌کند. این سیستم با دقت نزدیک به مدل‌های ابری،…

۳ دقیقه خواندن
AI
آموزش کاربردی

Mnemo: پیاده‌سازی حافظه بلندمدت با سرعت ۴.۲ میلی‌ثانیه برای عامل‌های هوش مصنوعی

ابزار Mnemo یک لایه‌ی حافظه محلی است که با استفاده از SQLite، گراف دانشی دائمی برای مدل‌های زبانی ایجاد می‌کند. این سیستم با سرعت کمتر از ۵۰ میلی‌ثانیه، با مدل‌های OpenAI،…

۲ دقیقه خواندن