پرش به محتوای اصلی

موضوع

هوش لبه

SLMs, on-device inference, mobile AI, AI PCs

۱٬۰۸۹ مقاله منتشر شده

از ۹۶۵ میلیارد دلار تا اولین حمله سایبری خودگردان: چرخش سریع در اکوسیستم AI

شرکت Anthropic برای IPO تریلیون دلاری خود اقدام کرد، در حالی که اولین حمله سایبری کاملاً خودگردان توسط عامل‌های هوش مصنوعی ثبت شد. انویدیا وارد بازار پردازنده‌های PC شد و اپل در…

۵ دقیقه خواندن
چرا ترکیب مدل‌های کوچک، رفتارهای انسانی‌تر از مدل‌های غول‌پیکر می‌سازد؟
آموزش کاربردی

چرا ترکیب مدل‌های کوچک، رفتارهای انسانی‌تر از مدل‌های غول‌پیکر می‌سازد؟

گزارش فنی جدیدی نشان می‌دهد که ترکیب چهار مدل زبانی کوچک از آزمایشگاه‌های مختلف، رفتارهای ارگانیک‌تر و استراتژی‌های اقتصادی پیچیده‌تری را نسبت به یک مدل واحد ایجاد می‌کند. این…

۶ دقیقه خواندن
آموزش کاربردی

Qualcomm AI Hub: مسیر مستقیم استقرار مدل‌های PyTorch روی سخت‌افزار واقعی

توسعه‌دهندگان اکنون می‌توانند مدل‌های PyTorch را به‌جای شبیه‌سازی، مستقیماً روی سخت‌افزارهای واقعی مانند گلکسی S24 بهینه‌سازی و اجرا کنند. این ابزار فاصله میان محیط‌های آزمایشگاهی…

۵ دقیقه خواندن
آموزش کاربردی

کاهش ۶۷ درصدی هزینه‌ی ذخیره‌سازی بردارها با بهینه‌سازی ابعاد مدل OpenAI

کاهش ابعاد بردارها در مدل text-embedding-3-small از ۱۵۳۶ به ۵۱۲، فضای مورد نیاز در دیتابیس‌های برداری را ۶۷٪ کاهش می‌دهد. این تغییر باعث کاهش تأخیر و هزینه‌ی حافظه می‌شود، اما…

۸ دقیقه خواندن
اشتراک ۲۰۰ دلاری Hatch؛ راهبرد متا برای بازگشت هزینه‌های زیرساختی هوش مصنوعی

اشتراک ۲۰۰ دلاری Hatch؛ راهبرد متا برای بازگشت هزینه‌های زیرساختی هوش مصنوعی

متا با معرفی سرویس Hatch، نخستین محصول پولی خود را برای اتوماسیون کارهای حرفه‌ای عرضه می‌کند. این اشتراک با قیمت ۲۰۰ دلار در ماه، مستقیماً با نسخه‌های پریمیوم OpenAI و Anthropic…

۱ دقیقه خواندن

درون شبکه ۴۰۰ میلیون‌گانه Bright Data برای دور زدن سدهای امنیتی هوش مصنوعی

بررسی‌های فنی نشان می‌دهد شرکت Bright Data با جاسازی SDK در اپلیکیشن‌های شریک، تلویزیون‌های هوشمند و گوشی‌ها را به پروکسی‌های مسکونی برای استخراج داده‌های وب تبدیل کرده است. این…

۱۰ دقیقه خواندن
آموزش کاربردی

چگونه مدل Gemma 4 گوگل با کمتر از ۱ گیگابایت حافظه روی موبایل اجرا می‌شود؟

گوگل با معرفی نقاط بازبینی جدید مبتنی بر آموزش آگاه از کوانتایزیشن (QAT)، مدل Gemma 4 E2B را به زیر ۱ گیگابایت حافظه رساند. این به‌روزرسانی امکان اجرای مدل‌های زبانی باکیفیت را…

۳ دقیقه خواندن۵