
OCR 4 در برابر رقبای تجاری؛ برتری در درک ساختار اسناد
شرکت Mistral AI مدل OCR 4 را برای درک ساختار اسناد معرفی کرد که در تستهای کور، در ۷۲٪ موارد ترجیح داوران را به دست آورده است. این ابزار با ارائه امتیاز اطمینان برای هر کلمه، دقت…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۳ مقاله منتشر شده

شرکت Mistral AI مدل OCR 4 را برای درک ساختار اسناد معرفی کرد که در تستهای کور، در ۷۲٪ موارد ترجیح داوران را به دست آورده است. این ابزار با ارائه امتیاز اطمینان برای هر کلمه، دقت…

یک سری فنی جدید بررسی میکند که چگونه فرآیند تقطیر، مدلهای غولپیکر و گرانقیمت را به نسخههایی چابک و تخصصی تبدیل میکند. این چرخش راهبردی، تخصص محلی و قابلاعتماد را به…

عامل هوشمند Hermes اکنون میتواند اسناد، لینکها و گفتگوها را بهطور خودکار به فایلهای مهارت قابلاستفاده تبدیل کند. این قابلیت نیاز به نوشتن دستی دستورالعملها را حذف کرده و با…

پژوهشگران دانشگاه سندیگو با معرفی DFlash، رمزگشایی گمانهزنانه را از حالت تکبهتک به بلوکهای موازی تغییر دادند. این متد بدون کاهش کیفیت خروجی، سرعت استنتاج را در سختافزارهای…

یک باگ رایج در پیادهسازی پروتکل زمینه مدل (MCP) باعث میشود خطاهای ۴۰۴ به اشتباه به عنوان شکست سیستمی تلقی شده و دسترسی عاملها به ابزارها را قطع کنند. راهکار این مشکل، تفکیک…

شرکت LuisCore ابزار GovernedBench v0 را برای جایگزینی وعدههای مبهم ایمنی با سناریوهای بازپذیری معرفی کرد. این چارچوب به توسعهدهندگان اجازه میدهد انطباق عاملهای هوشمند با…

پلتفرم EkkoJS با تبدیل محیط اجرا (Runtime) به بخشی از چرخه یادگیری، توهمات مدلهای کدنویس را حذف میکند. این ابزار با ارائه راهنمای زنده و ساختار امن، نیاز به تنظیم دقیق مدلها…

بررسی ۱۸۴ مدل زبانی طی ۳۰ روز نشان میدهد اعداد توان عملیاتی اعلامشده توسط شرکتها اغلب بیش از حد خوشبینانه هستند. استفاده از مسیریابی هوشمند بین مدلهای ارزانقیمت و پرمیوم…

پژوهشگران مجموعهای از مدلهای جهانی زبان به نام Qwen-AgentWorld را معرفی کردند که قادر به شبیهسازی محیطهای عاملمحور در هفت دامنه مختلف است. این مدلها با پیشبینی دینامیک محیط…

پروژه DiffusionBench با معرفی یک چارچوب ارزیابی یکپارچه، تلاش میکند معیارهای سنجش مدلهای ترنسفورمر انتشار را از تمرکز صرف بر ImageNet به تحلیلهای چندبعدی تغییر دهد. این ابزار…

مدل وزنباز M3 با پنجره متنی یک میلیون توکنی و قابلیتهای چندوجهی معرفی شد. این مدل با استفاده از معماری توجه پراکنده (MSA)، هزینه محاسباتی استنتاج در متون طولانی را بهشدت کاهش…

شرکت Superhuman برای ادغام ابزارهای تشخیص اصالت محتوا در دستیار نوشتاری خود، استارتاپ GPTZero را تصاحب کرد. این اقدام با هدف کاهش توهمات هوش مصنوعی و تضمین اصالت متون، بهویژه…