
۶ تلهٔ قیمتی که انتخاب مدل زبانی بزرگ را به اشتباه میاندازد
راهنمای جدیدی هشدار میدهد که جداول قیمت API معمولاً هزینههای واقعی مدلهای زبانی را پنهان میکنند. نادیده گرفتن تفاوتهای توکنسازی و نسبت ورودی به خروجی، منجر به صورتحسابهایی…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۶۹۱ مقاله منتشر شده

راهنمای جدیدی هشدار میدهد که جداول قیمت API معمولاً هزینههای واقعی مدلهای زبانی را پنهان میکنند. نادیده گرفتن تفاوتهای توکنسازی و نسبت ورودی به خروجی، منجر به صورتحسابهایی…

پلتفرم USD.AI بزرگترین وام تأمینشده با پشتوانه دارایی خود را برای تجهیز یک ارائهدهنده ابری به سیستمهای پیشرفته Blackwell انویدیا اختصاص داد. این معامله نشاندهنده ظهور «بازار…

یک توسعهدهنده در هکاتون Walrus Sessions 8 نشان داد که استفاده از ذخیرهسازی تغییرناپذیر (Immutable) مانع از فراموشی هوش مصنوعی میشود، اما چالشهای زمانی شدیدی ایجاد میکند. این…

ابزار متنباز secfoo با جایگزینی پرامپتهای مبهم با «مهارتهای» ساختاریافته، تکرارپذیری بررسیهای امنیتی توسط هوش مصنوعی را تضمین میکند. این ابزار با تعریف قراردادهای خروجی ثابت،…

خطاهای ساختاری در خروجیهای JSON مدلهای زبانی دیگر یک مشکل حلنشده نیستند. با جایگزینی روش «پرامپت و دعا» با یک خط لوله دترمینیستیک شامل طرحوارههای سختگیرانه و رمزگشایی محدود،…

تیم PixelPaws با توسعه Kavach، سیستمی عاملمحور برای شناسایی کلاهبرداری ساخته است که بهجای تکیه بر امتیازات مبهم ریسک، هر حکم را به شواهد عینی در گرافهای TigerGraph متصل میکند.…

چارچوب LensVLM با استفاده از مکانیزم گسترش انتخابی، اجازه میدهد مدلهای VLM تصاویر بهشدت فشرده را بدون افت دقت پردازش کنند. این سیستم با شناسایی نواحی حیاتی و بزرگنمایی آنها،…

شرکت OpenAI برای حفاظت از زیرساختهای غیرنظامی اوکراین در برابر حملات سایبری، دسترسی این کشور به برنامه Daybreak را فراهم کرد. این ابتکار با استفاده از مدلهای تخصصی، شناسایی نقاط…

شرکتهای Synopsys و TSMC با ادغام هوش مصنوعی عاملمحور در جریانهای طراحی نیمههادی، پیچیدگیهای چیدمان تراشههای چند-دای (Multi-die) را خودکار کردند. این همکاری سرعت توسعه…

اوپنایآی با معرفی MentalHealthBench، معیاری تخصصی شامل ۱۲۱۵ گفتگو برای ارزیابی عملکرد مدلهای هوش مصنوعی در سناریوهای سلامت روان ارائه کرد. این ابزار با استفاده از معیارهای…

آنتروپیک با استفاده از یک مدل پژوهشی داخلی، گلوگاههای عملکردی Claude.ai را شناسایی و رفع کرد. این رویکرد باعث شد زمان بارگذاری صفحات از ۳.۱ ثانیه به ۰.۵۵ ثانیه کاهش یابد.

انویدیا با معرفی MJWarp، موتور فیزیک MuJoCo را به GPU منتقل کرد تا اجرای هزاران شبیهسازی همزمان ممکن شود. این تغییر، گلوگاههای یادگیری تقویتی را از بین برده و سرعت آموزش هوش…