
کوانتش رسمی Mistral در برابر نسخههای شخص ثالث برای مدل ۱۱۹//B
شرکت Mistral با انتشار نقطه بازرسی رسمی NVFP4، نیاز حافظه مدل ۱۱۹ میلیاردی خود را به ۶۶ گیگابایت کاهش داد. این اقدام تفاوت حیاتی میان کوانتش رسمی سازنده و نسخههای غیررسمی شخص…
موضوع
Open-source models, open weights, local hosting, licensing
۲٬۰۳۶ مقاله منتشر شده

شرکت Mistral با انتشار نقطه بازرسی رسمی NVFP4، نیاز حافظه مدل ۱۱۹ میلیاردی خود را به ۶۶ گیگابایت کاهش داد. این اقدام تفاوت حیاتی میان کوانتش رسمی سازنده و نسخههای غیررسمی شخص…

محک جدید AgentDojo نشان میدهد تشخیصدهندههای متنباز در برابر حملات تزریق پرامپت که در خروجی ابزارها پنهان شدهاند، تقریباً ناتواناند. مدل Prompt Guard 2 متا و فیلترهای مبتنی…

بررسی هفت پایگاهداده برداری متنباز نشان میدهد که مرز اصلی میان ابزارهای سبک و موتورهای مقیاسپذیر، میزان حافظه رم مورد نیاز است. انتخاب ابزار مناسب بر اساس محدودیتهای…

بررسی فنی چهار چارچوب پیشرو در تولید بازیابیافزا (RAG) تفاوتهای بنیادینی را در مجوزها، نیازهای سختافزاری و قابلیتهای آفلاین آشکار میکند. این دادهها به توسعهدهندگان کمک…

شرکتها برای کاهش اصطکاکهای حقوقی و تجاریسازی سریعتر، به مجوز MIT در پروژههای هوش مصنوعی روی آوردهاند. با وجود انعطافپذیری بالا، تیمهای فنی همچنان باید سازگاری وزنهای مدل…

یک مدل بسیار کوچک با ۷.۲ میلیون پارامتر به عنوان لایه تریاژ برای درخواستهای هوش مصنوعی معرفی شده است. این سیستم با تشخیص وظایف ساده و ارجاع آنها به ابزارهای ارزان، از اتلاف…

اپل مدل بینایی-زبانی LensVLM-9B را معرفی کرد که با فشردهسازی تصاویر و بازگردانی گزینشی صفحات کلیدی به وضوح کامل، تعادل میان سرعت و دقت را برقرار میکند. این سازوکار اجازه میدهد…

پروژه متنباز NAEOS یک لایه حاکمیتی برای کنترل عاملهای هوش مصنوعی کدنویس ایجاد کرده است. این سامانه اجازه نمیدهد مدلها مستقیماً دستورات را اجرا کنند و هر اقدام را پیش از اجرا…

ابزار متنباز secfoo با جایگزینی پرامپتهای مبهم با «مهارتهای» ساختاریافته، تکرارپذیری بررسیهای امنیتی توسط هوش مصنوعی را تضمین میکند. این ابزار با تعریف قراردادهای خروجی ثابت،…

خطاهای ساختاری در خروجیهای JSON مدلهای زبانی دیگر یک مشکل حلنشده نیستند. با جایگزینی روش «پرامپت و دعا» با یک خط لوله دترمینیستیک شامل طرحوارههای سختگیرانه و رمزگشایی محدود،…

مینیپیسی VZmore AX Max با بهرهگیری از یک NPU اختصاصی، اجرای مدلهای زبانی بزرگ محلی مانند Qwen3-Coder را بدون متوقف کردن سیستم میزبان فراهم میکند. تستها نشان میدهد این…

یک پروژه متنباز جدید امکان ساخت عروسکهای هوشمند را فراهم میکند که بدون نیاز به اینترنت، چهرهها را شناسایی کرده و گفتگوهای فلسفی میکنند. این سیستم تمام پردازشها را در شبکه…