پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۲٬۰۴۰ مقاله منتشر شده

رمزگشایی از مکانیسم توجه: چرا پرامپت‌های شما گاهی با توهم پاسخ می‌دهند؟
آموزش کاربردی

رمزگشایی از مکانیسم توجه: چرا پرامپت‌های شما گاهی با توهم پاسخ می‌دهند؟

مدل‌های زبانی واقعاً حقایق را نمی‌شناسند، بلکه موتورهای آماری برای پیش‌بینی توکن بعدی هستند. درک معماری ترنسفورمر و فرآیند RLHF به کاربران کمک می‌کند تا توهمات را کاهش داده و…

۱۰ دقیقه خواندن
چرا ترکیب مدل‌های کوچک، رفتارهای انسانی‌تر از مدل‌های غول‌پیکر می‌سازد؟
آموزش کاربردی

چرا ترکیب مدل‌های کوچک، رفتارهای انسانی‌تر از مدل‌های غول‌پیکر می‌سازد؟

گزارش فنی جدیدی نشان می‌دهد که ترکیب چهار مدل زبانی کوچک از آزمایشگاه‌های مختلف، رفتارهای ارگانیک‌تر و استراتژی‌های اقتصادی پیچیده‌تری را نسبت به یک مدل واحد ایجاد می‌کند. این…

۶ دقیقه خواندن۱
آموزش کاربردی

چگونه micropython-wasm اجرای کدهای ناشناس در عامل‌های هوش مصنوعی را امن می‌کند؟

سایمون ویلیسون بسته‌ای آزمایشی برای اجرای کدهای پایتون در یک سندباکس وب‌اسمبلی منتشر کرد تا از دسترسی پلاگین‌های مخرب به داده‌های خصوصی جلوگیری کند. این سیستم با استفاده از…

۷ دقیقه خواندن۲
آموزش کاربردی

Qualcomm AI Hub: مسیر مستقیم استقرار مدل‌های PyTorch روی سخت‌افزار واقعی

توسعه‌دهندگان اکنون می‌توانند مدل‌های PyTorch را به‌جای شبیه‌سازی، مستقیماً روی سخت‌افزارهای واقعی مانند گلکسی S24 بهینه‌سازی و اجرا کنند. این ابزار فاصله میان محیط‌های آزمایشگاهی…

۵ دقیقه خواندن
گزارش dev.to: کاهش ۹۷.۵ درصدی هزینه‌های استنتاج با جایگزینی APIهای مستقیم
آموزش کاربردی

گزارش dev.to: کاهش ۹۷.۵ درصدی هزینه‌های استنتاج با جایگزینی APIهای مستقیم

استفاده از یک روتر API یکپارچه به جای اتصال مستقیم به ارائه‌دهندگان، می‌تواند هزینه‌های مدل‌های زبانی را تا ۹۷٪ کاهش دهد. این رویکرد وابستگی به یک فروشنده خاص را از بین می‌برد و…

۹ دقیقه خواندن۱
آموزش کاربردی

چگونه مدل Gemma 4 گوگل با کمتر از ۱ گیگابایت حافظه روی موبایل اجرا می‌شود؟

گوگل با معرفی نقاط بازبینی جدید مبتنی بر آموزش آگاه از کوانتایزیشن (QAT)، مدل Gemma 4 E2B را به زیر ۱ گیگابایت حافظه رساند. این به‌روزرسانی امکان اجرای مدل‌های زبانی باکیفیت را…

۳ دقیقه خواندن۸
چرا ابزاری که یک‌سوم دنیای هوش مصنوعی را می‌چرخاند، سازنده‌اش را نجات نمی‌دهد؟

چرا ابزاری که یک‌سوم دنیای هوش مصنوعی را می‌چرخاند، سازنده‌اش را نجات نمی‌دهد؟

گزارش جدید Wiz نشان می‌دهد llamafile اکنون در ۳۳٪ از زیرساخت‌های ابری هوش مصنوعی حضور دارد و از ابزارهای رسمی بسیاری پیشی گرفته است. با این حال، سازنده‌ی این پروژه در وضعیتی…

۳ دقیقه خواندن۴
بررسی مانیفست مقاومت متن‌باز؛ استراتژی جدید برای توقف فرسودگی برنامه‌نویسان
زندگی با AI

بررسی مانیفست مقاومت متن‌باز؛ استراتژی جدید برای توقف فرسودگی برنامه‌نویسان

مایک مک‌کواید، رهبر پروژه Homebrew، مانیفستی به نام «مقاومت متن‌باز» را معرفی کرد. این جنبش از توسعه‌دهندگان می‌خواهد نگهداری نرم‌افزارهای متن‌باز را به‌عنوان بخشی از وظایف اداری…

۲ دقیقه خواندن