
درون سازوکار استنتاجِ درونمرورگری در ابزار ChangelogPro
ابزار ChangelogPro با استفاده از WebGPU، تبدیل لاگهای گیت به یادداشتهای انتشار را بهصورت کاملاً محلی و بدون ارسال داده به سرور انجام میدهد. این رویکرد حریم خصوصی توسعهدهندگان…
موضوع
Open-source models, open weights, local hosting, licensing
۱٬۹۳۵ مقاله منتشر شده

ابزار ChangelogPro با استفاده از WebGPU، تبدیل لاگهای گیت به یادداشتهای انتشار را بهصورت کاملاً محلی و بدون ارسال داده به سرور انجام میدهد. این رویکرد حریم خصوصی توسعهدهندگان…

عامل جدید Mano-CUA با تکیه بر بینایی خالص، در وظایف پیچیدهٔ پر کردن فرمهای وب عملکردی بهتر از مدلهای عمومی مانند Claude 4.5 و Gemini 2.5 Pro داشت. این مدل برخلاف LLMها، به جای…

پروژه Don Watch با ترکیب WebGPU و WebLLM، یک دوقلوی دیجیتال از رودخانه دان در شفیلد ساخته است که کاملاً روی دستگاه کاربر اجرا میشود. این ابزار بدون نیاز به سرور ابری، تحلیلهای…

روهان بانسال با استفاده از یک مدل ۴ میلیارد پارامتری Qwen و ترکیب تنظیم دقیق نظارتشده با یادگیری تقویتی، توانست برنامههای اجرای پرسوجو در PostgreSQL را بهینه کند. این مدل با…

شرکت Nunchux AI با معرفی هسته VC-Attention، گلوگاههای محاسباتی در ترنسفورمرهای انتشار ویدیو را بدون نیاز به آموزش مجدد مدل برطرف کرد. این متد با بهینهسازی مرحله سافتمکس و…

شرکت Knowledgator مدل GLiFormer را معرفی کرد؛ رمزگذاریکنندهای که استخراج اطلاعات پیچیده را بدون تأخیر تولید توکن به توکن انجام میدهد. این مدل در ساختاربندی JSONهای تو در تو با…

پلتفرم Common Crawl آرشیوهای عظیم خود را روی Hugging Face منتقل کرد تا توسعهدهندگان بدون نیاز به دانلود کامل دادهها، از طریق پروتکلهای ابری و کوئریهای SQL به آنها دسترسی…

شرکت آنتروپیک ثابت کرد که مدلهای زبانی بزرگ میتوانند کل چرخه طراحی پروتئین، از پژوهش تا رتبهبندی، را بدون دخالت انسان مدیریت کنند. این دستاورد نشان میدهد ارکستراسیون پیچیده…

مدل متنباز Jevlike با جایگزینی تولید کلمه-به-کلمه با مکانیزم امتیازدهی تکمرحلهای، سرعت استنتاج را در وظایف انتخابی ۱۰۰ برابر افزایش داده است. این رویکرد نیاز به مدلهای مولد…

تیم Linum با معرفی معماری JiT-DDT، نیاز به خودرمزگذار وردشی (VAE) را حذف و آموزش مدلهای تبدیل متن به تصویر را ۳.۶ برابر سریعتر کرد. این رویکرد جدید با انتقال به فضای پیکسل،…

موتور استنتاج جدید Colibrì با استریم کردن خبرهها از حافظه SSD، اجرای مدلهای عظیم ۱۵۰ میلیاردی را روی لپتاپهای معمولی ممکن کرد. یافتهها نشان میدهد گلوگاه اصلی عملکرد، نه سرعت…

خرید سختافزار GPU برای توسعه هوش مصنوعی بهدلیل هزینههای اولیه بالا و سرعت کهنگی سریع، معمولاً منجر به کاهش هزینهها نمیشود. برای اکثر تیمهای کوچک، استفاده از APIهای ابری…