پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۲٬۰۳۶ مقاله منتشر شده

کاهش ۳۲ درصدی زمان رفع خرابی در امریکن اکسپرس با استفاده از عامل‌های هوش مصنوعی
آموزش کاربردی

کاهش ۳۲ درصدی زمان رفع خرابی در امریکن اکسپرس با استفاده از عامل‌های هوش مصنوعی

تیم‌های SRE در حال گذار از تحلیل ساده‌ی هشدارها به «بررسی عامل‌محور» هستند؛ سیستمی که در آن هوش مصنوعی برای یافتن علت ریشه‌ای خطا، مستقیماً ابزارهای زیرساختی را اجرا می‌کند. این…

۲ دقیقه خواندن۲
بهینه‌سازی Gemma 4 در لبه: جایگزینی تنظیم دقیق با سیستم امتیازدهی خودکار
آموزش کاربردی

بهینه‌سازی Gemma 4 در لبه: جایگزینی تنظیم دقیق با سیستم امتیازدهی خودکار

توسعه‌دهندگان می‌توانند به‌جای تنظیم دقیق هزینه‌بر، از یک مدل بزرگ‌تر برای تولید و امتیازدهی به پرامپت‌های مدل‌های لبه استفاده کنند. این روش «ارتقای مهارت پرامپت» پایداری سیستم را…

۲ دقیقه خواندن۲
چگونه Gemma 4 تبدیل یادداشت‌های پراکنده به مستندات فنی را خودکار می‌کند؟
آموزش کاربردی

چگونه Gemma 4 تبدیل یادداشت‌های پراکنده به مستندات فنی را خودکار می‌کند؟

یک توسعه‌دهنده با استفاده از Gemma 4 ابزاری ساخته است که یادداشت‌های نامنظم پروژه را به مستندات ساختاریافته‌ی نرم‌افزاری تبدیل می‌کند. این سیستم با خودکارسازی تولید User Storyها و…

۲ دقیقه خواندن
AntAngelMed: دستیابی به عملکرد مدل‌های ۴۰ میلیاردی با ۶.۱ میلیارد پارامتر فعال

AntAngelMed: دستیابی به عملکرد مدل‌های ۴۰ میلیاردی با ۶.۱ میلیارد پارامتر فعال

مدل AntAngelMed با معماری MoE و نسبت فعال‌سازی ۱/۳۲، توانسته است عملکرد مدل‌های متراکم ۴۰ میلیاردی را با هزینه محاسباتی بسیار کمتر بازتولید کند. این مدل در حال حاضر رتبه نخست…

۳ دقیقه خواندن۱
چرا مدل‌های محلی ۱۳ میلیاردی با Statewright در کدنویسی به دقت ۱۰۰ درصدی رسیدند؟
آموزش کاربردی

چرا مدل‌های محلی ۱۳ میلیاردی با Statewright در کدنویسی به دقت ۱۰۰ درصدی رسیدند؟

پلتفرم Statewright با معرفی «گاردریل‌های ماشین وضعیت»، دسترسی عامل‌های هوش مصنوعی به ابزارها را بر اساس مرحله‌ی جاریِ گردش کار محدود می‌کند. این رویکرد قطعی باعث شد مدل‌های محلی…

۲ دقیقه خواندن۱
چگونه منطق لودرها در Hugging Face، ابزارهای امنیتی سنتی را دور می‌زنند؟

چگونه منطق لودرها در Hugging Face، ابزارهای امنیتی سنتی را دور می‌زنند؟

پژوهشگران امنیتی بدافزارهایی را در Hugging Face یافتند که با جعل نام OpenAI، از طریق اسکریپت‌های نصب به سیستم‌ها نفوذ می‌کنند. این حملات به جای هدف قرار دادن مدل‌ها، روی منطق…

۲ دقیقه خواندن
چرا برای طبقه‌بندی اسناد محرمانه، مدل‌های غول‌پیکر دیگر ضروری نیستند؟

چرا برای طبقه‌بندی اسناد محرمانه، مدل‌های غول‌پیکر دیگر ضروری نیستند؟

مدل‌های زبانی کوچک و محلی اکنون می‌توانند اسناد دولتی حساس را با دقتی نزدیک به مدل‌های تجاری ابری طبقه‌بندی کنند. پژوهشگران با ترکیب زنجیره تفکر و نمونه‌های خطا-محور، توانستند…

۲ دقیقه خواندن۲