پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۹۳۴ مقاله منتشر شده

کد پایتونی ۲۵ خطی برای شبیه‌سازی مدل Jevons (مصرف زغال‌سنگ)
آموزش کاربردی

پیاده‌سازی هستهٔ Jev در ۲۵ خط کد پایتون؛ افشای سازوکار طبقه‌بندی احتمالات

یک نمایش فنی نشان می‌دهد که قابلیت‌های تصمیم‌گیری Jev برخلاف هیاهوهای تبلیغاتی، بر یک سازوکار سادهٔ طبقه‌بندی احتمالات استوار است. این پیاده‌سازی محلی ثابت می‌کند که برای مدل‌های…

۲ دقیقه خواندن۴
لایه آموزش‌ندیده نوکیا برای تبدیل هر مدل زبانی باز به سیستم تصمیم‌گیری کالیبره‌شده
آموزش کاربردی

نوکیا: AnyJev سوگیری‌های موقعیتی LLM را بدون آموزش مجدد حذف می‌کند

نوکیا کتابخانه AnyJev را برای تبدیل مدل‌های زبانی باز به موتورهای تصمیم‌گیری کالیبره‌شده منتشر کرد. این ابزار بدون نیاز به آموزش مجدد، سوگیری‌های موقعیتی را حذف و قابلیت اطمینان…

۴ دقیقه خواندن
اتوماسیون کامل چرخه ساخت-تست-دیپلوی روی پردازنده‌های اپل سیلیکون: درس‌های آموخته‌شده
آموزش کاربردی

مدل ۴ میلیاردی Mano-AFK صحت استقرار خودکار اپلیکیشن‌ها را به ۵۸٪ رساند

پلتفرم Mininglamp چارچوب متن‌باز Mano-AFK را برای خودکارسازی کامل چرخه ساخت، تست و استقرار روی مک‌های اپل منتشر کرد. این مدل در تولید مستندات و رفع باگ‌های ساده موفق است، اما در…

۶ دقیقه خواندن۱
بررسی وزن‌دهی توالی در مقیاس بزرگ

پژوهش Jane Street: اثر وزن‌دهی داده‌ها در مقیاس‌های مختلف غیرخطی است

محققان Jane Street دریافتند که تأثیر وزن‌دهی داده‌ها بر یادگیری مدل‌ها با تغییر مقیاس، تغییر می‌کند. در حالی که مدل‌های متوسط به وزن‌ها حساس‌اند، مدل‌های بسیار کوچک و بسیار بزرگ،…

۸ دقیقه خواندن۱
مک‌بوک پرو اپل سیلیکون با قدرت پردازش هوش مصنوعی در کنار نمایشگر استودیو دیسپلی

درون معماری تراشه‌های اپل؛ چرا مک‌ها برای هوش مصنوعی محلی ایده‌آل شدند

انتقال اپل به تراشه‌های اختصاصی، محیطی سخت‌افزاری ایجاد کرد که به‌طور طبیعی برای اجرای محلی مدل‌های زبانی بزرگ ایده‌آل است. حافظه یکپارچه و طراحی GPU در مک‌ها، اجرای مدل‌های پیشرو…

۵ دقیقه خواندن۱
دو مدل زبانی بزرگ در حال رقابت زنده با کدهای GLSL در محیطی تعاملی.
آموزش کاربردی

«لاگ‌های سخت‌افزاری»؛ معیار جدید Refract برای ارزیابی مدل‌های زبانی

پلتفرم Refract با جایگزینی بنچمارک‌های انتزاعی با رندرهای زنده GPU، مدل‌های زبانی را در محیطی رقابتی برای نوشتن شیدرهای GLSL به چالش می‌کشد. در این سامانه، لاگ‌های خطای واقعی…

۴ دقیقه خواندن۱
لوگوی پروژه CAIRن سازمان سیسکو تالوس برای شکار بدافزارهای مجهز به هوش مصنوعی
آموزش کاربردی

ابزار CAIRN ردپای بدافزارهای هدایت‌شده توسط هوش مصنوعی را شکار می‌کند

سیسکو ابزار متن‌باز CAIRN را برای شناسایی بدافزارهای عامل‌محور معرفی کرد که به‌جای تحلیل کد، روی متاداده‌ها تمرکز دارد. نخستین یافته این ابزار، بدافزار CLOSEDQUORUM است که برای…

۶ دقیقه خواندن۱
پرچم‌دار مقرون‌به‌صرفه هوش مصنوعی شیائومی پیشتاز مدل‌های متن‌باز است

درون چالش‌های عرضه MiMo-V2.6؛ از راندمان هزینه تا حقوق کپی‌رایت

شیائومی سری MiMo-V2.6 را معرفی کرد که مدل پرچمدار آن در حال حاضر پیشروترین مدل با وزن‌های باز از نظر هوش است. با وجود بهره‌وری هزینه‌ای خیره‌کننده، این عرضه با اتهامات آنتروپیک…

۳ دقیقه خواندن
مدل‌های زبانی کوچک تخصصی در عملیات از مدل‌های بزرگ پیشرو پیشی می‌گیرند
آموزش کاربردی

مدل‌های زبانی کوچک در محیط‌های عملیاتی بر مدل‌های پیشرو پیروز شدند

مدل‌های زبانی کوچک (SLM) با کاهش تأخیر و هزینه‌ها، در وظایف تخصصی عملکردی بهتر از مدل‌های غول‌پیکر دارند. شرکت‌ها اکنون به‌جای اجاره‌ی APIهای گران‌قیمت، با تنظیم دقیق مدل‌های…

۹ دقیقه خواندن