پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۶۶۱ مقاله منتشر شده

چرا ترکیب مدل‌های کوچک، رفتارهای انسانی‌تر از مدل‌های غول‌پیکر می‌سازد؟
آموزش کاربردی

چرا ترکیب مدل‌های کوچک، رفتارهای انسانی‌تر از مدل‌های غول‌پیکر می‌سازد؟

گزارش فنی جدیدی نشان می‌دهد که ترکیب چهار مدل زبانی کوچک از آزمایشگاه‌های مختلف، رفتارهای ارگانیک‌تر و استراتژی‌های اقتصادی پیچیده‌تری را نسبت به یک مدل واحد ایجاد می‌کند. این…

۶ دقیقه خواندن۱
آموزش کاربردی

Qualcomm AI Hub: مسیر مستقیم استقرار مدل‌های PyTorch روی سخت‌افزار واقعی

توسعه‌دهندگان اکنون می‌توانند مدل‌های PyTorch را به‌جای شبیه‌سازی، مستقیماً روی سخت‌افزارهای واقعی مانند گلکسی S24 بهینه‌سازی و اجرا کنند. این ابزار فاصله میان محیط‌های آزمایشگاهی…

۵ دقیقه خواندن
آموزش کاربردی

کاهش ۶۷ درصدی هزینه‌ی ذخیره‌سازی بردارها با بهینه‌سازی ابعاد مدل OpenAI

کاهش ابعاد بردارها در مدل text-embedding-3-small از ۱۵۳۶ به ۵۱۲، فضای مورد نیاز در دیتابیس‌های برداری را ۶۷٪ کاهش می‌دهد. این تغییر باعث کاهش تأخیر و هزینه‌ی حافظه می‌شود، اما…

۸ دقیقه خواندن۲
اشتراک ۲۰۰ دلاری Hatch؛ راهبرد متا برای بازگشت هزینه‌های زیرساختی هوش مصنوعی

اشتراک ۲۰۰ دلاری Hatch؛ راهبرد متا برای بازگشت هزینه‌های زیرساختی هوش مصنوعی

متا با معرفی سرویس Hatch، نخستین محصول پولی خود را برای اتوماسیون کارهای حرفه‌ای عرضه می‌کند. این اشتراک با قیمت ۲۰۰ دلار در ماه، مستقیماً با نسخه‌های پریمیوم OpenAI و Anthropic…

۱ دقیقه خواندن

درون شبکه ۴۰۰ میلیون‌گانه Bright Data برای دور زدن سدهای امنیتی هوش مصنوعی

بررسی‌های فنی نشان می‌دهد شرکت Bright Data با جاسازی SDK در اپلیکیشن‌های شریک، تلویزیون‌های هوشمند و گوشی‌ها را به پروکسی‌های مسکونی برای استخراج داده‌های وب تبدیل کرده است. این…

۱۰ دقیقه خواندن
آموزش کاربردی

چگونه مدل Gemma 4 گوگل با کمتر از ۱ گیگابایت حافظه روی موبایل اجرا می‌شود؟

گوگل با معرفی نقاط بازبینی جدید مبتنی بر آموزش آگاه از کوانتایزیشن (QAT)، مدل Gemma 4 E2B را به زیر ۱ گیگابایت حافظه رساند. این به‌روزرسانی امکان اجرای مدل‌های زبانی باکیفیت را…

۳ دقیقه خواندن۷
چرا ابزاری که یک‌سوم دنیای هوش مصنوعی را می‌چرخاند، سازنده‌اش را نجات نمی‌دهد؟

چرا ابزاری که یک‌سوم دنیای هوش مصنوعی را می‌چرخاند، سازنده‌اش را نجات نمی‌دهد؟

گزارش جدید Wiz نشان می‌دهد llamafile اکنون در ۳۳٪ از زیرساخت‌های ابری هوش مصنوعی حضور دارد و از ابزارهای رسمی بسیاری پیشی گرفته است. با این حال، سازنده‌ی این پروژه در وضعیتی…

۳ دقیقه خواندن۴
بازگشت به واقعیت؛ چرا Halide Mark III پردازش‌های هوش مصنوعی را کنار گذاشت؟

بازگشت به واقعیت؛ چرا Halide Mark III پردازش‌های هوش مصنوعی را کنار گذاشت؟

اپلیکیشن Halide Mark III با معرفی قابلیت Looks، رویکردی ضد-هوش مصنوعی را برای بازگشت به رنگ‌های طبیعی در عکاسی موبایل پیش گرفته است. این برنامه که با همکاری کالن کلی ساخته شده،…

۳ دقیقه خواندن۳
چطور گره‌های محلی هوش مصنوعی هزینه‌های ماهانه CRM را به صفر می‌رسانند؟
آموزش کاربردی

چطور گره‌های محلی هوش مصنوعی هزینه‌های ماهانه CRM را به صفر می‌رسانند؟

پلتفرم BizNode با انتقال مدیریت مشتریان و جذب لید از فضای ابری به سخت‌افزار محلی، مدل اشتراکی SaaS را با خرید یک‌باره جایگزین کرده است. این ابزار با استفاده از یک استک محلی، امنیت…

۲ دقیقه خواندن