پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۸۱ مقاله منتشر شده

پیش‌نمایش مرحله ۵ - تحلیل هوش، عملکرد و قیمت | تحلیل مصنوعی

شاخص Intelligence Index v4.3 معیار سنجش هوش را به سمت کاربرد عامل‌محور برد

پلتفرم Artificial Analysis با به‌روزرسانی شاخص هوش خود به نسخه ۴.۳، ۱۰ ارزیابی جدید برای سنجش استدلال و قابلیت اطمینان مدل‌ها معرفی کرد. این تغییر رویکرد، تمرکز را از پاسخ‌های…

۴ دقیقه خواندن
برنامه‌نویس در حال تماشای دو مدل هوش مصنوعی که با هم بحث می‌کنند، یکی کد می‌نویسد و دیگری آن را بازبینی می‌کند.
آموزش کاربردی

سیستم AdversarialDebate نرخ تطابق تشخیص باگ‌های هوش مصنوعی را به ۸۸.۷٪ رساند

یک توسعه‌دهنده با شناسایی پدیده «لنگر انداختن» در بررسی‌های چندمدلی، سیستمی را طراحی کرد که مدل‌ها را مجبور به استدلال مستقل می‌کند. این رویکرد تخاصمی، نرخ تطابق با نتایج واقعی…

۵ دقیقه خواندن۲
نقش کارشناسی علوم سیاره‌ای USRA در مدل بنیاد ماه ناسا-آی‌بی‌ام

مدل Lunar در برابر استانداردهای ImageNet برای شناسایی یخ‌های قطبی

ناسا و آی‌بی‌ام یک مدل بنیادی متن‌باز برای تحلیل داده‌های ماه منتشر کردند که در شناسایی دهانه‌ها و نقشه‌برداری از یخ‌های قطبی، مدل‌های استاندارد هوش مصنوعی را شکست می‌دهد.

۴ دقیقه خواندن۱
ردیابی یک تنسور از ریاضی مدل تا هزینه سرویس‌دهی
آموزش کاربردی

نقشه راه Trace a Tensor: پیوند ریاضیات مدل‌ها با هزینه‌های استقرار

یک برنامه آموزشی جدید فاصله میان ریاضیات تئوریک هوش مصنوعی و هزینه‌های واقعی اجرای مدل‌ها در محیط عملیاتی را پر می‌کند. این متدولوژی به توسعه‌دهندگان می‌آموزد تا با ردیابی یک…

۲ دقیقه خواندن۳
چرا قابلیت اطمینان هوش مصنوعی ممکن است مرز بعدی خدمات زیرساخت مدیریت‌شده باشد
آموزش کاربردی

گزارش پایش: مدل ۵ لایه‌ای قابلیت اطمینان جایگزین SLA می‌شود

پایش سنتی زیرساخت قادر به شناسایی شکست‌های رفتاری هوش مصنوعی مانند توهم یا انتخاب اشتباه ابزار نیست. سازمان‌ها باید از مدل‌های سادهٔ پایداری (SLA) به سمت مدل‌های پنج‌لایهٔ قابلیت…

۹ دقیقه خواندن۱
جلوگیری از کارکرد کلید لو رفته عامل هوش مصنوعی با توکن‌های دسترسی Kinde
آموزش کاربردی

چطور توکن‌های کوتاه‌مدت ریسک نشت اعتبارنامه‌های هوش مصنوعی را می‌گیرند؟

یک نمایش فنی نشان می‌دهد که اکثر عامل‌های هوش مصنوعی از اعتبارنامه‌های طولانی‌مدت استفاده می‌کنند که حتی پس از نشت، روزها معتبر می‌مانند. با پیاده‌سازی توکن‌های دسترسی چرخان،…

۹ دقیقه خواندن۱
شکایت مصرف‌کنندگان از آنتروپیک، اوپن‌ای‌آی، اسپیس‌ایکس‌ای‌آی و گوگل به اتهام تبانی در حوزه هوش مصنوعی

«کاهش عمدی سرعت پیشرفت»؛ محور شکایت کاربران از غول‌های هوش مصنوعی

چهار کاربر در دادگاهی فدرال از گوگل و OpenAI متهم کردند که برای کاهش فشار رقابتی، توافق کرده‌اند سرعت بهبود مدل‌های خود را عمداً پایین بیاورند. شاکیان مدعی‌اند این اقدام با نقض…

۵ دقیقه خواندن۷
مدل هوش مصنوعی علی‌بابا برای تشخیص سرطان و نزدیک به ۱۵۰ بیماری منبع‌باز شد

مدل Damo Radar علی‌بابا ۱۴۶ بیماری شکمی را از روی سی‌تی‌اسکن تشخیص می‌دهد

آکادمی دمو متعلق به علی‌بابا، مدل بینایی-زبانی Damo Radar را به‌صورت متن‌باز منتشر کرد. این مدل قادر است ۱۴۶ وضعیت بالینی مختلف در ناحیه شکم را با دقت بالا شناسایی کند.

۱ دقیقه خواندن۲
انتخاب قطعی ابزار از طریق MCP برای حل پارادوکس کارایی مدل‌های زبانی بزرگ
آموزش کاربردی

انتخاب‌گر ریاضی در برابر شهود مدل‌های زبانی در مدیریت ابزارها

رویکرد جدیدی در گردش‌کارهای عامل‌محور، «شهود» احتمالی مدل‌های زبانی را با یک انتخاب‌گر ریاضی جایگزین می‌کند. این متد با جداسازی تصمیم‌گیری از استدلال، تضمین می‌کند که عامل…

۴ دقیقه خواندن۱
تحلیل بازار مالی با هوش مصنوعی: جستجوی مزیت رقابتی
زندگی با AI

داده‌های اختصاصی در برابر ابزارهای AI؛ جابه جایی مرکز ثقل سودآوری

دموکراتیزه شدن تحلیل‌های مالی توسط هوش مصنوعی در حال تبدیل کردن الگوهای بازار به کالاهایی ارزان و بی‌ارزش است. در این فضای جدید، مزیت رقابتی از داشتن ابزار به داشتن داده‌های…

۵ دقیقه خواندن
طراحی مجدد پروژه‌های کد کلود برای هماهنگی رشته‌های عامل هوشمند

سازوکار هماهنگ‌کننده در Claude Code؛ گذار از پوشه به مدیریت عامل‌های موازی

آنتروپیک سیستم پروژه‌های Claude Code را بازطراحی کرد تا به‌جای مدیریت دستی پوشه‌ها، از یک هماهنگ‌کننده مرکزی برای توزیع وظایف بین چندین عامل موازی استفاده کند. این به‌روزرسانی…

۴ دقیقه خواندن۳