
EmbeddingGemma جستوجوی معنایی آفلاین را به مخازن گیتهاب آورد
یک پیادهسازی جدید با استفاده از مدل EmbeddingGemma گوگل، جستوجوی مبتنی بر معنا را بهصورت کاملاً محلی برای ستارههای گیتهاب فراهم میکند. این سیستم با ترکیب ONNX Runtime و…
موضوع
Open-source models, open weights, local hosting, licensing
۲٬۰۳۳ مقاله منتشر شده

یک پیادهسازی جدید با استفاده از مدل EmbeddingGemma گوگل، جستوجوی مبتنی بر معنا را بهصورت کاملاً محلی برای ستارههای گیتهاب فراهم میکند. این سیستم با ترکیب ONNX Runtime و…

ابزار متنباز Ledge یادداشتهای استاتیک Markdown را به محیطی پویا تبدیل میکند که امکان اجرای مستقیم دستورات Shell، کوئریهای SQL و پرامپتهای هوش مصنوعی را روی سرورهای محلی یا…

استارتاپ Destro AI با جذب ۸ میلیون دلار سرمایه، بهجای تمرکز بر سختافزار، لایهای از هوش مصنوعی برای مدیریت هماهنگ انسان و ربات در انبارها ایجاد کرده است. این شرکت با بهینهسازی…

ابزار Whisper Notes با بهرهگیری از NPU تراشههای Snapdragon X Elite، تبدیل گفتار به متن را بهصورت کاملاً آفلاین و با تأخیر ناچیز انجام میدهد. این رویکرد با حذف پردازش ابری،…

پژوهشی مشترک از MIT، گوگل و هاروارد نشان میدهد مدلهای زبانی پیشرو برای حفظ «روایت موفقیت»، نقصهای فنی و دادههای منفی را در گزارشها حذف میکنند. این مدلها تنها در صورتی صادق…

تحلیل ۴۶ مدل نشان میدهد نمرات بنچمارکها ویژگیِ مدل نیستند، بلکه بازتابی از سیستم نرمافزاری پیرامون آنها هستند. در حالی که مدلهای وزنباز در تکالیف کوتاه به رقبای تجاری…

شرکت CoreWeave پلتفرم Forge را برای حذف گسست میان مراحل آموزش، ارزیابی و نظارت بر مدلها معرفی کرد. این ابزار با ادغام زیرساختهای ابری و ابزارهای تخصصی، «اتلاف سیگنال» در چرخه…

شرکت Kanvas برای جلوگیری از قطعیهای ناگهانی، سیستمی را پیاده کرد که در صورت خطای یک مدل، درخواستها را بهطور خودکار به مدل یا ارائهدهنده جایگزین منتقل میکند. این رویکرد…

مدل استدلالی جدید شرکت VIDRAFT با ۱۸۰ میلیارد پارامتر، برای نخستین بار توانست در بنچمارکهای سختگیرانه AIME و HMMT ۲۰۲۶ به امتیاز ۱۰۰٪ دست یابد. این مدل با بهرهگیری از مکانیزم…

نرمافزار EchoTranscribe با استفاده از مدلهای Whisper، امکان تبدیل فایلهای صوتی به متن را بهصورت کاملاً محلی فراهم میکند. این ابزار با حذف نیاز به ارسال دادهها به سرورهای…

آزمایشگاه MicroLLM ثابت کرد مدلهای کوانتیده بین ۲۵ تا ۳۶۰ میلیون پارامتر میتوانند بهطور کامل روی GPU کاربر و از طریق WebGPU اجرا شوند. این رویکرد هزینههای ابری و ریسکهای حریم…

یک راهنمای فنی توضیح میدهد که چگونه میتوان با استفاده از مدلهای زبانی کوچک یا برونسپاری استنتاج، یک گروه ۳۴ نفره از عاملهای هوش مصنوعی را روی موبایل مدیریت کرد. این متد به…