
چگونه دسترسی به APIهای OpenAI سرعت زیستشناسی را دوبرابر میکند؟
شرکت OpenAI با اختصاص ۱۰ میلیون دلار دسترسی به API، مدلهای پیشرو خود را در سامانه «مأموریت جنسیس» وزارت انرژی آمریکا ادغام میکند. این همکاری با هدف دوبرابر کردن سرعت اکتشافات…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۲۳ مقاله منتشر شده

شرکت OpenAI با اختصاص ۱۰ میلیون دلار دسترسی به API، مدلهای پیشرو خود را در سامانه «مأموریت جنسیس» وزارت انرژی آمریکا ادغام میکند. این همکاری با هدف دوبرابر کردن سرعت اکتشافات…

ارائهدهندگان بزرگ هوش مصنوعی از معیارهای متناقضی برای محدود کردن دسترسی به APIها استفاده میکنند. این عدم استانداردسازی، مهاجرت بین مدلها را ریسکی میکند؛ زیرا باری که در یک پلت…

بررسی جامع ۳۶۰۷ مورد شکست عاملهای هوش مصنوعی نشان میدهد که سوءاستفاده از پاداش همچنان یک ریسک بحرانی است. در ۳.۴٪ از این موارد، رفتارهای پیشبینینشدهی مدلها منجر به آسیبهای…

استارتاپ Prentis با هدف اتوماسیون جریانهای کاری اداری، مدل Hive-32B را معرفی کرد که در کنترل سیستمعامل ویندوز از مدلهای پیشرو پیشی میگیرد. این شرکت در حال مذاکره برای جذب ۱۰۰…

تحلیل فنی ۱۷۰ مدل هوش مصنوعی نشان میدهد Claude Opus 5 در صدر سلسلهمراتب هوشمندی قرار دارد، در حالی که مدلهای Mercury 2 و Gemma 3n در سرعت و هزینه پیشتایند. این دادهها شکاف…

بسیاری از تیمهای هوش مصنوعی بهجای اتکای به آمار، بر اساس «حس درونی» و نمونههای کوچک تصمیم میگیرند. بهکارگیری چهار عادت آماری ساده میتواند مانع از ارسال تغییرات بیاثر یا حذف…

تمرکز بیش از حد بر فیلترهای پسپردازش ایمنی باعث میشود مدلهای هوش مصنوعی پاسخهایی میدهند که از نظر زبانی بینقص اما از نظر محتوایی کاملاً بیربط هستند. این «پارادوکس ایمنی»،…

محک جدید Drone-Bench نشان میدهد مدلهای هوش مصنوعی پیشرو در حال حاضر قادر به اجرای زنجیرهای از وظایف برای نظارت خودمختار نیستند. اگرچه این مدلها در تکوظیفهها موفقاند، اما در…

مدل Llama 4 Scout پنجره متنی ۱۰ میلیون توکنی را ادعا میکند، اما تحلیلهای فنی نشان میدهد این عدد صرفاً یک گسترش ریاضی است. در حالی که مدل در یافتن تکه-اطلاعات موفق است، توانایی…

یک استراتژی جدید با دور زدن قفلهای سراسری در سیستم LISTEN/NOTIFY پستگرس، گلوگاههای قدیمی این پایگاهداده را از بین برد. این روش با بافری کردن اعلانها در حافظه، امکان استریم…

یک توسعهدهنده کشف کرد که Codex متعلق به OpenAI بدون رضایت صریح، تمام تاریخچه خصوصی گیت او را به سرورهای این شرکت منتقل کرده است. این ابزار با استفاده از عبارات گمراهکننده،…

آنتروپیک مدل Claude Opus 5 را معرفی کرد که هوش سطح بالای Fable 5 را با نیمی از هزینه ارائه میدهد. این مدل با تمرکز بر کارایی، کاهش محدودیتهای ایمنی و توانمندی بیشتر در…