پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۹۵۰ مقاله منتشر شده

پل تُرول — عامل‌های هوشمند را فقط جایی که می‌خواهید، رها کنید.
آموزش کاربردی

trollbridge دسترسی شبکه‌ای عامل‌های هوش مصنوعی را با لایه‌ی تأیید انسانی محدود

ابزار trollbridge یک پروکسی HTTP است که از درخواست‌های غیرمجاز عامل‌های هوش مصنوعی به وب جلوگیری می‌کند. این سیستم با ترکیب لیست‌های دسترسی و یک مشاور هوش مصنوعی، ترافیک مشکوک را…

۶ دقیقه خواندن۲
مدل زبانی بزرگ با تأخیر کم برای تولید متن طبیعی
آموزش کاربردی

آیا معماری MoE می‌تواند تأخیر بین‌توکنی را بدون کاهش دقت حذف کند؟

بهینه‌سازی تولید زبان طبیعی نیازمند موازنه بین زمان تا نخستین توکن و تأخیر بین‌توکنی است. استفاده از معماری ترکیب خبره‌ها اجازه می‌دهد عمق استدلال مدل حفظ شود و در عین حال توان…

۲ دقیقه خواندن
راهنمای OfficeCLI: نحوه استفاده، بهترین پرامپت‌ها و کاربردها (۲۰۲۶)
آموزش کاربردی

OfficeCLI: عامل‌های هوش مصنوعی اکنون اسناد آفیس را می‌بینند و اصلاح می‌کنند

ابزار متن‌باز OfficeCLI به عامل‌های هوش مصنوعی اجازه می‌دهد بدون نیاز به نصب مایکروسافت آفیس، فایل‌های Word، Excel و PowerPoint را تولید و رندر کنند. این ابزار با ایجاد یک حلقهٔ…

۱۰ دقیقه خواندن۱
مقایسه GPT و معماری ترکیبی متخصصان در مدل‌های زبانی بزرگ
آموزش کاربردی

معماری ترکیب خبره‌ها، کلید کاهش هزینه‌های استنتاج در مدل‌های زبانی بزرگ

مدل‌های زبانی مدرن بین دو مسیر معماری متراکم و ترکیب خبره‌ها (MoE) تقسیم شده‌اند. در حالی که مدل‌های متراکم از تمام توان خود برای هر پاسخ استفاده می‌کنند، MoE تنها بخش‌های تخصصی…

۳ دقیقه خواندن
بررسی سریع آلودگی داده در معیارهای برنامه‌نویسی هوش مصنوعی با ساخت ابزار کوچک
آموزش کاربردی

گزارش OpenAI: نشت داده‌ها اعتبار بنچ‌مارک‌های کدنویسی را از بین برد

گزارش جدید OpenAI نشان می‌دهد بسیاری از جدول‌های رتبه‌بندی کدنویسی به‌دلیل تداخل داده‌های آموزشی و آزمون غیرقابل‌اعتماد هستند. این تحلیل تأکید می‌کند که نمرات بدون بررسی دقیق نشت…

۲ دقیقه خواندن
معیارسنجی رایانه شخصی هوشمند: باتری، حرارت و بازیابی حالت خواب
آموزش کاربردی

معیارهای سنجش عمر باتری و بازیابی سیستم در PCهای هوش مصنوعی RTX Spark

یک چارچوب جدید برای تست PCهای هوش مصنوعی معرفی شده است که به‌جای تمرکز بر اعداد خام سخت‌افزاری، بر سناریوهای واقعی چرخهٔ عمر دستگاه تمرکز می‌کند. این متد به‌ویژه نحوه‌ی رفتار…

۲ دقیقه خواندن۲
راهنمای API مدل‌های زبانی باز: آنچه آرزو داشتم زودتر می‌دانستم
آموزش کاربردی

میزبانی شخصی LLMها تنها برای حجم بالای ۵۰ میلیون توکن در روز به‌صرفه است

تحلیل هزینه‌های زیرساختی نشان می‌دهد که استفاده از APIها برای اکثر توسعه‌دهندگان ارزان‌تر از استقرار مدل‌های وزن‌باز است. هزینه‌های پنهان عملیاتی و سخت‌افزاری، مزیت مالی مدل‌های…

۷ دقیقه خواندن
هوش مصنوعی محلی برای کسب‌وکار: کاهش هزینه بدون ارسال داده به ابر
آموزش کاربردی

«خروج از ابر»؛ راهکار جدید کسب‌و‌کارهای کوچک برای امنیت داده‌ها

انتقال مدل‌های هوش مصنوعی از ابر به سخت‌افزار محلی، ریسک نشت داده‌ها و هزینه‌های اشتراک ماهانه را برای کسب‌وکارهای کوچک از بین می‌برد. تمرکز بر وظایف تخصصی مانند نویسه‌خوانی نوری،…

۲ دقیقه خواندن
پنجره HuggingChat در حال تحلیل فایل لاگ با نمودار خطای زمانی و هشدارهای رنگی
آموزش کاربردی

تحلیل رایگان لاگ‌های سرور با HuggingChat؛ جایگزینی متن‌باز برای ابزارهای

متخصصان سئو اکنون می‌توانند با استفاده از مدل‌های رایگان و متن‌باز HuggingChat، داده‌های خام سرور را تحلیل کرده و نقاط اتلاف بودجه خزش را شناسایی کنند. این گردش‌کار، لاگ‌های…

۱۳ دقیقه خواندن
شناسایی پنهان CPU fallback و tok/s اشتباه در LLM‌های محلی. پشتیبانی از llama.cpp و ollama، تک‌فایل، بدون وابستگی.
آموزش کاربردی

ابزار Picchio افشای «پس‌نشینی خاموش» مدل‌های محلی به CPU و خطاهای کوانتش

ابزار Picchio با تطبیق لاگ‌های موتور استنتاج و تله‌متری سخت‌افزاری، لحظه‌ای را که مدل‌های زبانی از GPU به CPU منتقل می‌شوند شناسایی می‌کند. این ابزار همچنین برچسب‌های کوانتش…

۷ دقیقه خواندن