پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۸۴۶ مقاله منتشر شده

سخت‌افزار سیستم‌های یادگیری ماشین: معماری، شتاب‌دهنده‌ها و بهینه‌سازی انرژی
آموزش کاربردی

معماری سخت‌افزاری؛ تعیین‌کنندهٔ سرعت و هزینهٔ مدل‌های یادگیری ماشین

بهره‌وری هوش مصنوعی به انتخاب درست میان CPU، GPU و تراشه‌های تخصصی ASIC بستگی دارد. در حالی که GPUها در مقیاس کوچک غالب هستند، تراشه‌های عصبی و لبه‌ای در حال تغییر مرزهای محاسبات…

۱ دقیقه خواندن۱
معرفی Muse Glimmer: مدل عاملی متن‌باز که روی دستگاه شما اجرا می‌شود
آموزش کاربردی

مدل Muse Glimmer متا: اجرای عامل‌های ۳۰ میلیارد پارامتری روی GPUهای خانگی

متا مدل Muse Glimmer را به عنوان یک مدل وزن‌باز ۳۰ میلیارد پارامتری برای اجرای محلی عامل‌های هوش مصنوعی منتشر کرد. این مدل با استفاده از کوانتش ۴ بیتی و رمزگشایی گمانه‌زنانه، روی…

۶ دقیقه خواندن۳
چارچوب R.A.H.S.I.: هوش مصنوعی دستورالعمل‌ها را اجرا کرد؛ شواهد اطمینان کجاست؟
آموزش کاربردی

شکاف میان تست و تضمین؛ دلیل شکست مقیاس‌پذیری عامل‌های هوش مصنوعی در سازمان‌ها

اجرای دستورات به معنای کنترل‌پذیری سیستم نیست. چارچوب R.A.H.S.I استدلال می‌کند که سازمان‌ها برای مقیاس‌بندی امن عامل‌های هوش مصنوعی، به جای نتایج تست، به شواهد قابل حسابرسی از…

۲ دقیقه خواندن۲
بروزرسانی مدل را مانند پروتکل بازپخش، نه امتیاز بنچمارک، در نظر بگیرید
آموزش کاربردی

پروتکل بازپخش در برابر بنچمارک؛ راهکاری برای تضمین پایداری مدل‌های عملیاتی

اتکای صرف به نمرات بنچمارک برای ارتقای مدل‌های هوش مصنوعی اغلب به دلیل نقض قراردادهای فنی در محیط عملیاتی منجر به شکست می‌شود. پروتکل بازپخش (Replay Protocol) با شبیه‌سازی ترافیک…

۷ دقیقه خواندن۲
ساخت اولین عامل CRO هوش مصنوعی با کلود (بدون کد، ۶۰ دقیقه)
آموزش کاربردی

«بهینه‌سازی روی رفتارهای غیرانسانی»؛ نقطه ضعف عامل‌های CRO در نبود فیلترینگ

ساخت یک عامل هوش مصنوعی برای بهینه‌سازی نرخ تبدیل (CRO) با Claude تنها ۶۰ دقیقه زمان می‌برد، اما نبود فیلترهای شناسایی ربات باعث می‌شود مدل روی رفتارهای غیرانسانی بهینه‌سازی شود.…

۲۷ دقیقه خواندن۲
هیاهوی MiniMax H3: معیارسنجی یک مدل کوچک باز در جایی که کاربرانتان واقعاً هستند
آموزش کاربردی

«نادیده گرفتن نوسانات سخت‌افزاری»؛ دلیل گمراه‌کننده بودن نتایج مدل‌های AI

محک‌های استاندارد هوش مصنوعی با نادیده گرفتن نوسانات سخت‌افزاری موبایل، نتایجی گمراه‌کننده ارائه می‌دهند. چارچوب جدید تست مدل MiniMax H3 بر توان بازیابی سیستم پس از قطع اتصال…

۵ دقیقه خواندن۲
هر هفته یک مدل متن‌باز جدید منتشر می‌شود؛ این روش ۳۰دقیقه‌ای به شما می‌گوید آیا ارزش صرف بودجه CI را دارد.
آموزش کاربردی

ارزیابی بر اساس کدبیس اختصاصی در برابر رده‌بندی‌های عمومی مدل‌های AI

یک فرآیند ارزیابی تکرارپذیر به توسعه‌دهندگان اجازه می‌دهد تا به‌جای تکیه بر جدول‌های رده‌بندی عمومی، مدل‌های وزن‌باز را با ۶ تسک واقعی بسنجند. این روش با استفاده از منابع رایگان،…

۵ دقیقه خواندن۲
استارتاپ‌هایی که به دنبال نسل بعدی مدل‌های زبانی بزرگ هستند

۴ استارتاپ با بازطراحی معماری ترنسفورمر هزینه مدل‌های زبانی را کاهش می‌دهند

موج جدیدی از استارتاپ‌ها در تلاش‌اند تا معماری استاندارد ترنسفورمر را جایگزین کنند تا هزینه‌های سرسام‌آور انرژی و محدودیت‌های پنجره متنی را حل کنند. این شرکت‌ها با استفاده از…

۱۱ دقیقه خواندن۴
متن پنهان در PDF برای سرقت داده از طریق عامل هوش مصنوعی Rovo شرکت Atlassian کافی است

آیا متون نامرئی PDF می‌توانند داده‌های Confluence را به سرقت ببرند؟

یک آسیب‌پذیری بحرانی در عامل هوش مصنوعی Rovo امکان استخراج داده‌های حساس Jira و Confluence را از طریق تزریق پرامپت‌های نامرئی در فایل‌های PDF فراهم می‌کند. این حفره امنیتی علی‌رغم…

۲ دقیقه خواندن