
عامل بینایی Mano-CUA در اتوماسیون وب از Claude 4.5 پیشی گرفت
عامل جدید Mano-CUA با تکیه بر بینایی خالص، در وظایف پیچیدهٔ پر کردن فرمهای وب عملکردی بهتر از مدلهای عمومی مانند Claude 4.5 و Gemini 2.5 Pro داشت. این مدل برخلاف LLMها، به جای…
موضوع
SLMs, on-device inference, mobile AI, AI PCs
۱٬۶۸۳ مقاله منتشر شده

عامل جدید Mano-CUA با تکیه بر بینایی خالص، در وظایف پیچیدهٔ پر کردن فرمهای وب عملکردی بهتر از مدلهای عمومی مانند Claude 4.5 و Gemini 2.5 Pro داشت. این مدل برخلاف LLMها، به جای…

پروژه Don Watch با ترکیب WebGPU و WebLLM، یک دوقلوی دیجیتال از رودخانه دان در شفیلد ساخته است که کاملاً روی دستگاه کاربر اجرا میشود. این ابزار بدون نیاز به سرور ابری، تحلیلهای…

پلتفرم Baize با استفاده از زبان Go، محیط اجرای عاملهای هوش مصنوعی را به یک پردازش جانبی (Sidecar) تبدیل کرده است. این رویکرد با حذف وابستگیهای پیچیده پایتون، استقرار سریع و امن…

روهان بانسال با استفاده از یک مدل ۴ میلیارد پارامتری Qwen و ترکیب تنظیم دقیق نظارتشده با یادگیری تقویتی، توانست برنامههای اجرای پرسوجو در PostgreSQL را بهینه کند. این مدل با…

شرکت Knowledgator مدل GLiFormer را معرفی کرد؛ رمزگذاریکنندهای که استخراج اطلاعات پیچیده را بدون تأخیر تولید توکن به توکن انجام میدهد. این مدل در ساختاربندی JSONهای تو در تو با…

شرکت Telnyx یک معماری مرجع TypeScript منتشر کرد که با استفاده از لایهی دادههای مشترک، دستیاران هوش مصنوعی را با وبسایت و داشبوردهای فروش همگام میکند. این راهکار مانع از ایجاد…

مدل متنباز Jevlike با جایگزینی تولید کلمه-به-کلمه با مکانیزم امتیازدهی تکمرحلهای، سرعت استنتاج را در وظایف انتخابی ۱۰۰ برابر افزایش داده است. این رویکرد نیاز به مدلهای مولد…

متا برای مقابله با انتقادات مربوط به حریم خصوصی، در حال توسعه عینک هوشمند Luna است که هیچ دوربینی ندارد. این دستگاه بهجای ثبت تصویر، بر تعاملات صوتی با هوش مصنوعی تمرکز میکند.

موتور استنتاج جدید Colibrì با استریم کردن خبرهها از حافظه SSD، اجرای مدلهای عظیم ۱۵۰ میلیاردی را روی لپتاپهای معمولی ممکن کرد. یافتهها نشان میدهد گلوگاه اصلی عملکرد، نه سرعت…

پژوهش جدید CetinLM ثابت کرد که پیشآموزش مدلهای بنیادی لزوماً نیازمند خوشههای میلیاردی نیست. این تیم با بهینهسازیهای سطح پایین، موفق شد بیش از ۲ میلیارد توکن را تنها با یک…

اپل قصد دارد تا سال ۲۰۲۹ با ترکیب تراشههای سری M و فناوری اتصال انویدیا، دوباره وارد بازار سرور شود. این استراتژی برای تأمین نیازهای عظیم محاسباتی عصر هوش مصنوعی طراحی شده است.

سازمانهای بهداشتی برای جلوگیری از نشت اطلاعات حساس بیماران به زیرساختهای ابری، به سمت استقرار مدلهای زبانی درونسازمانی حرکت میکنند. این رویکرد با کنترل کامل مسیر داده، امکان…