پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۲٬۰۳۶ مقاله منتشر شده

مک‌بوک پرو اپل سیلیکون با قدرت پردازش هوش مصنوعی در کنار نمایشگر استودیو دیسپلی
اخبار کوتاه روزانه

درون معماری تراشه‌های اپل؛ چرا مک‌ها برای هوش مصنوعی محلی ایده‌آل شدند

انتقال اپل به تراشه‌های اختصاصی، محیطی سخت‌افزاری ایجاد کرد که به‌طور طبیعی برای اجرای محلی مدل‌های زبانی بزرگ ایده‌آل است. حافظه یکپارچه و طراحی GPU در مک‌ها، اجرای مدل‌های پیشرو…

۵ دقیقه خواندن۲
دو مدل زبانی بزرگ در حال رقابت زنده با کدهای GLSL در محیطی تعاملی.
آموزش کاربردی

«لاگ‌های سخت‌افزاری»؛ معیار جدید Refract برای ارزیابی مدل‌های زبانی

پلتفرم Refract با جایگزینی بنچمارک‌های انتزاعی با رندرهای زنده GPU، مدل‌های زبانی را در محیطی رقابتی برای نوشتن شیدرهای GLSL به چالش می‌کشد. در این سامانه، لاگ‌های خطای واقعی…

۴ دقیقه خواندن۱
لوگوی پروژه CAIRن سازمان سیسکو تالوس برای شکار بدافزارهای مجهز به هوش مصنوعی
آموزش کاربردی

ابزار CAIRN ردپای بدافزارهای هدایت‌شده توسط هوش مصنوعی را شکار می‌کند

سیسکو ابزار متن‌باز CAIRN را برای شناسایی بدافزارهای عامل‌محور معرفی کرد که به‌جای تحلیل کد، روی متاداده‌ها تمرکز دارد. نخستین یافته این ابزار، بدافزار CLOSEDQUORUM است که برای…

۶ دقیقه خواندن۱
پرچم‌دار مقرون‌به‌صرفه هوش مصنوعی شیائومی پیشتاز مدل‌های متن‌باز است
اخبار کوتاه روزانه

درون چالش‌های عرضه MiMo-V2.6؛ از راندمان هزینه تا حقوق کپی‌رایت

شیائومی سری MiMo-V2.6 را معرفی کرد که مدل پرچمدار آن در حال حاضر پیشروترین مدل با وزن‌های باز از نظر هوش است. با وجود بهره‌وری هزینه‌ای خیره‌کننده، این عرضه با اتهامات آنتروپیک…

۳ دقیقه خواندن
مدل‌های زبانی کوچک تخصصی در عملیات از مدل‌های بزرگ پیشرو پیشی می‌گیرند
آموزش کاربردی

مدل‌های زبانی کوچک در محیط‌های عملیاتی بر مدل‌های پیشرو پیروز شدند

مدل‌های زبانی کوچک (SLM) با کاهش تأخیر و هزینه‌ها، در وظایف تخصصی عملکردی بهتر از مدل‌های غول‌پیکر دارند. شرکت‌ها اکنون به‌جای اجاره‌ی APIهای گران‌قیمت، با تنظیم دقیق مدل‌های…

۹ دقیقه خواندن
ترنسفورمرز اکنون از کوانتیزه‌شده‌های llama.cpp پشتیبانی می‌کند
آموزش کاربردی

چگونه مدل‌های GGUF اکنون از طریق هسته‌های ggml اجرا می‌شوند؟

هگینگ‌فیس پشتیبانی از مدل‌های کوانتیده GGUF را به کتابخانه transformers اضافه کرد. این به‌روزرسانی به توسعه‌دهندگان اجازه می‌دهد مدل‌های بهینه را بدون نیاز به موتورهای خارجی و با…

۱۰ دقیقه خواندن۱
هوش مصنوعی و حریم خصوصی: راهنمای حفظ اطلاعات شخصی
آموزش کاربردی

محیط‌های اجرای مورد اعتماد؛ سدی ریاضی در برابر جاسوسی شرکت‌های هوش مصنوعی

اکثر چت‌بات‌های هوش مصنوعی داده‌های حساس کاربران را ذخیره می‌کنند و حریم خصوصی را به وعده‌های شرکتی گره می‌زنند. ابزارهای جدید با استفاده از TEEها و مدل‌های محلی، دسترسی…

۱۰ دقیقه خواندن۱
استقرار مدل‌های LLM روی پلتفرم‌های ابری با مقیاس‌پذیری خودکار: بهترین شیوه‌ها
آموزش کاربردی

«گلوگاه پهنای‌باند حافظه»؛ دلیل شکست مقیاس‌دهی سنتی در مدل‌های زبانی

مقیاس‌دهی خودکار بر اساس CPU برای مدل‌های زبانی شکست می‌خورد زیرا گلوگاه واقعی در پهنای‌باند حافظه و KV-cache است. توسعه‌دهندگان با جایگزینی معیارهای سنتی با «عمق صف»، می‌توانند…

۳ دقیقه خواندن۳
ژون کیم، سازنده و نگهدارنده oMLX، برای حمایت از جامعه MLX به هاگینگ فیس می‌پیوندد.

درون استراتژی Hugging Face برای تسریع اجرای مدل‌ها روی تراشه‌های اپل

شرکت هگینگ‌فیس برای بهینه‌سازی ابزارهای هوش مصنوعی محلی روی تراشه‌های اپل، جُن کیم (خالق oMLX) را استخدام کرد. این اقدام باعث تبدیل oMLX از یک پروژه جانبی به یک ابتکار رسمی برای…

۲ دقیقه خواندن
پرچم‌دار جدید شیائومی با امتیاز ۴۶ در صدر جدول مدل‌های متن‌باز قرار گرفت

مدل‌های وزن‌باز در برابر سیستم‌های بسته؛ برتری جدید شیائومی در شاخص هوش

شیائومی سری MiMo-V2.6 را با یک مدل پرچم‌دار ۱.۰۲ تریلیون پارامتری منتشر کرد که در حال حاضر رتبه اول جدول مدل‌های وزن‌باز Artificial Analysis را در اختیار دارد. این مدل با…

۵ دقیقه خواندن