پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۹۴۹ مقاله منتشر شده

عامل کد Juggler: ابزار هوشمند خودکارسازی برنامه‌نویسی در گیت‌هاب
آموزش کاربردی

Juggler؛ میزکاری بصری برای کنترل دقیق عامل‌های کدنویس هوش مصنوعی

پلتفرم Juggler با جایگزینی چت‌های خطی با یک ساختار درختی، امکان بازگشت و ویرایش مسیر تفکر مدل‌های زبانی را فراهم می‌کند. این ابزار به توسعه‌دهندگان اجازه می‌دهد تا هر مرحله از…

۶ دقیقه خواندن
تنظیم دقیق و RAG: درس‌هایی از دوازده آزمایش ناموفق
آموزش کاربردی

مدل‌های کوچک در پیش‌بینی‌های مالی نویزی بر مدل‌های غول‌آسا پیروز شدند

آزمایش‌های جدید نشان می‌دهد که تنظیم دقیق و RAG نمی‌توانند سیگنال‌های پیش‌بینی‌کننده را در داده‌های نویزی خلق کنند. مدل‌های بزرگ‌تر تمایل دارند به جای الگو، «نویز» را حفظ کنند و…

۸ دقیقه خواندن۱
منابع رایگان یادگیری هوش مصنوعی که هنوز توصیه می‌کنم
آموزش کاربردی

۱۰ منبع رایگان برای تسلط بر هوش مصنوعی بدون نیاز به دوره‌های گران‌قیمت

یک یادگیرنده با‌تجربه فهرستی از منابع رایگان و باکیفیت برای یادگیری هوش مصنوعی در سال ۲۰۲۶ را معرفی کرد. این راهنما بر تمرین عملی و استفاده از ابزارهای متن‌باز به‌جای دریافت…

۸ دقیقه خواندن
راهنمای عملی یکپارچه‌سازی مدل‌های متن‌باز در ساخت نرم‌افزار
آموزش کاربردی

APIهای چندارائه‌دهنده «مالیات زیرساختی» مدل‌های وزن‌باز را حذف کردند

توسعه‌دهندگان برای فرار از وابستگی به یک شرکت و کاهش هزینه‌ها، به سمت مدل‌های وزن‌باز حرکت می‌کنند. APIهای جدید اکنون امکان استقرار این مدل‌ها را بدون نیاز به مدیریت پیچیده…

۵ دقیقه خواندن
با Blume آشنا شوید: چارچوب مستندات متن‌باز بدون نیاز به پیکربندی که از پوشه Markdown مستندات آماده هوش مصنوعی تولید می‌کند.
آموزش کاربردی

Blume: تبدیل پوشه‌های مارک‌داون به سایت‌های مستندات سازگار با عامل‌های AI

Blume یک چارچوب متن‌باز جدید است که پوشه‌های Markdown را بدون نیاز به تنظیمات پیچیده به سایت‌های مستندات حرفه‌ای تبدیل می‌کند. این ابزار با پشتیبانی بومی از پروتکل MCP و تولید…

۵ دقیقه خواندن۲
درگاه پل ارتباطی بدون کپی برای استنتاج چند عاملی روی GPU: دوخت پویا کش KV در سطح حافظه با PagedAttention، کاهش ۲۵ برابری تأخی
آموزش کاربردی

«به اشتراک‌گذاری حافظه در سطح سخت‌افزار»؛ راهکار جدید برای بهینه‌سازی KV Cache

ابزار جدید MemStitch با به اشتراک‌گذاری حافظه KV Cache در سطح سخت‌افزاری، مراحل تکراری پیش‌پُرکردن را حذف می‌کند. این فناوری زمان پاسخ‌دهی اولیه و مصرف VRAM را برای عامل‌هایی که…

۳ دقیقه خواندن
رونمایی رسمی DeepSeek V4: قیمت‌های اوج در راه است — اما چرا توسعه‌دهندگان غربی همچنان برنده‌اند
آموزش کاربردی

DeepSeek V4 با مدل قیمت‌گذاری ساعتی، هزینه استنتاج را ۶ برابر ارزان‌تر از

مدل DeepSeek V4 با معرفی ساختار قیمت‌گذاری ساعتی، هزینه‌های عملیاتی را برای توسعه‌دهندگان به‌شدت کاهش داد. این مدل حتی در ساعات اوج مصرف نیز به مراتب ارزان‌تر از رقبای غربی است و…

۴ دقیقه خواندن۱
نهنگ افتاده هوش مصنوعی و متن‌باز: انتقاد کوچک
زندگی با AI

پرتوکنی‌های رایگان؛ فرصتی برای تسویه بدهی‌های فنی در دنیای متن‌باز

آزمایشگاه‌های پیشرو هوش مصنوعی در حال پرداخت هزینه‌های نجومی محاسبات هستند و پنجره‌ای موقت برای توسعه‌دهندگان متن‌باز گشوده‌اند. هدف این است که از این توکن‌های ارزان برای ساخت…

۴ دقیقه خواندن