پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۲٬۰۴۰ مقاله منتشر شده

۳.۴۷ دلار هزینه API و ۴۷ ساعت صرفه‌جویی: سازوکار جدید اتوماسیون تیکت‌ها
آموزش کاربردی

۳.۴۷ دلار هزینه API و ۴۷ ساعت صرفه‌جویی: سازوکار جدید اتوماسیون تیکت‌ها

یک توسعه‌دهنده با استفاده از OpenRouter و Node.js سیستمی برای پردازش تیکت‌های مشتریان طراحی کرد که هزینه‌های API را ۶۸٪ کاهش داد. این معماری سبک توانست در سه هفته ۴۷ ساعت از زمان…

۲ دقیقه خواندن
AI
آموزش کاربردی

چگونه OpenJarvis هزینه استنتاج عامل‌های هوش مصنوعی را ۸۰۰ برابر کاهش داد؟

پلتفرم متن‌باز OpenJarvis از دانشگاه استنفورد و آزمایشگاه‌های Lambda، امکان اجرای عامل‌های هوش مصنوعی را به‌صورت کاملاً محلی فراهم می‌کند. این سیستم با دقت نزدیک به مدل‌های ابری،…

۳ دقیقه خواندن۱
AI
آموزش کاربردی

Mnemo: پیاده‌سازی حافظه بلندمدت با سرعت ۴.۲ میلی‌ثانیه برای عامل‌های هوش مصنوعی

ابزار Mnemo یک لایه‌ی حافظه محلی است که با استفاده از SQLite، گراف دانشی دائمی برای مدل‌های زبانی ایجاد می‌کند. این سیستم با سرعت کمتر از ۵۰ میلی‌ثانیه، با مدل‌های OpenAI،…

۲ دقیقه خواندن۱
AI

سازوکار Gemma 4 برای اجرای مدل‌های چندوجهی روی لپ‌تاپ با ۱۶ گیگابایت رم

گوگل مدل Gemma 4 12B را منتشر کرد؛ مدل چندوجهی میان‌اندازه‌ای که بدون نیاز به انکودرهای مجزا، صدا و تصویر را پردازش می‌کند. این مدل با مجوز آپاچی ۲.۰، برای اجرا روی سخت‌افزارهای…

۳ دقیقه خواندن
AI
آموزش کاربردی

چرا تکیه به پرامپت برای امنیت عامل‌های هوش مصنوعی یک اشتباه است؟

پلتفرم متن‌باز Cast با انتقال قوانین دسترسی از پرامپت‌ها به فایل‌های تنظیمات سخت، امنیت عامل‌های هوش مصنوعی را تضمین می‌کند. این ابزار اجازه می‌دهد تیم‌ها بدون ترس از نشت اطلاعات،…

۲ دقیقه خواندن
AI

رمزگشایی از روش DharmaOCR برای کاهش ۵۹ درصدی حلقه‌های تکراری در استخراج متن

تنظیم دقیق نظارتی (SFT) اغلب در توقف حلقه‌های تکرار در وظایف ساختاریافته شکست می‌خورد. DharmaOCR با تبدیل این خروجی‌های معیوب به سیگنال‌های منفی در بهینه‌سازی مستقیم ترجیحات…

۳ دقیقه خواندن
AI

شرکت H: مدل Holo3.1 زمان اجرای گام‌های عامل‌های محلی را ۵۰٪ کاهش داد

شرکت H خانواده مدل‌های Holo3.1 را برای استقرار محلی و موبایلی عامل‌های کامپیوتری معرفی کرد. این به‌روزرسانی با بهره‌گیری از کوانتایزیشن NVFP4، تأخیر اجرای هر گام را از ۶.۸ ثانیه…

۲ دقیقه خواندن۱