
«بهینهترین گزینه برای استنتاج»؛ تحلیل عملکرد M5 Ultra در برابر انویدیا
مک استودیو M5 Ultra با پهنایباند حافظه ۴.۴ برابر بیشتر از NVIDIA DGX Spark، گزینهای بهینه برای استنتاج محلی مدلهای زبانی بزرگ است. با این حال، انویدیا همچنان در زمینه تنظیم…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۸۲ مقاله منتشر شده

مک استودیو M5 Ultra با پهنایباند حافظه ۴.۴ برابر بیشتر از NVIDIA DGX Spark، گزینهای بهینه برای استنتاج محلی مدلهای زبانی بزرگ است. با این حال، انویدیا همچنان در زمینه تنظیم…

نسخه ۴.۱۰.۰ پلتفرم LangBot با معرفی یک محیط ایزوله (Sandbox) و سیستم مهارتهای پویا، امکان اجرای دستورات شل و مدیریت فایلها را برای عاملها فراهم کرد. این بهروزرسانی عاملها را…

نسخه ۴.۹.۰ پلتفرم LangBot با بازطراحی کامل سیستم پایگاه دانش، منطق RAG را از هسته سیستم جدا کرد. اکنون توسعهدهندگان میتوانند بدون تغییر در کد اصلی، پایگاهدادههای برداری و…

محک جدید Codex How To نشان میدهد افزودن عاملهای بیشتر لزوماً کیفیت کد را بالا نمیبرد، بلکه هزینه توکن و ریسک ادغام را افزایش میدهد. این مطالعه تأکید میکند ارکستراسیون تنها…

اوپنایآی از تراشه اختصاصی Jalapeño برای استنتاج هوش مصنوعی رونمایی کرد که در بهرهوری انرژی و کاهش تأخیر، برترین ابرتراشههای انویدیا را پشت سر میگذارد. این سختافزار برای کاهش…

پژوهشگران متد جدیدی به نام PISA ابداع کردند که با تحلیل دقیق اثر هر باز DNA، نویزهای آزمایشگاهی را از پیشبینیهای مدلهای هوش مصنوعی جدا میکند. این ابزار به دانشمندان اجازه…

فرمت جدیدی به نام SELF اجازه میدهد برنامهها بهصورت پایگاهداده SQLite وجود داشته باشند و وضعیت و محتوای خود را در همان فایل اجرایی ذخیره کنند. این رویکرد مرز میان کد، تنظیمات و…

شرکت Liquid AI ابزار متنباز Pipette را برای اندازهگیری دقیق عملکرد مدلهای هوش مصنوعی روی سختافزارهای مختلف معرفی کرد. دادههای اولیه نشان میدهد مدلهایی با تعداد پارامتر…

یک نقص بحرانی در منطق بررسی مسیرها به عاملهای هوش مصنوعی اجازه میدهد با استفاده از Symlinkها، فایلهایی را خارج از پوشههای مجاز بنویسند. این آسیبپذیری حتی با وجود استفاده از…

یک حسابرسی مالی روی پروتکل پرداخت x402 نشان میدهد که اکثر نقاط انتهایی هوش مصنوعی پس از دریافت وجه، خدمات را ارائه نمیکنند. این مطالعه فاش کرد که ۹۳٪ از کاتالوگ Coinbase Bazaar…

مدل جدید Darwin-36B-Opus توانست در یکی از سختترین محکهای استدلال، با مدلی ۱۱ برابر بزرگتر برابری کند. این دستاورد بهجای آموزش سنگین با GPU، از طریق یک فرآیند تکاملی برای ترکیب…

دیوید بوکانان ثابت کرد که مدل اعتماد C2PA در اندروید از طریق اکسپلویتهای روت و حملات سختافزاری قابل دور زدن است. این نقص به مهاجمان اجازه میدهد تصاویر تولیدشده توسط هوش مصنوعی…