پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۸۲۳ مقاله منتشر شده

پیوستن اوپن‌ای‌آی به ابتکار علمی آمریکا: گامی بزرگ برای تسریع اکتشافات

چگونه دسترسی به APIهای OpenAI سرعت زیست‌شناسی را دوبرابر می‌کند؟

شرکت OpenAI با اختصاص ۱۰ میلیون دلار دسترسی به API، مدل‌های پیشرو خود را در سامانه «مأموریت جنسیس» وزارت انرژی آمریکا ادغام می‌کند. این همکاری با هدف دوبرابر کردن سرعت اکتشافات…

۴ دقیقه خواندن
مقایسه محدودیت نرخ API مدل‌های زبانی بزرگ (۲۰۲۶): ۵ ارائه‌دهنده، ۵ قانون متفاوت
آموزش کاربردی

۵ استاندارد متناقض در محدودیت‌های API ارائه‌دهندگان هوش مصنوعی

ارائه‌دهندگان بزرگ هوش مصنوعی از معیارهای متناقضی برای محدود کردن دسترسی به APIها استفاده می‌کنند. این عدم استانداردسازی، مهاجرت بین مدل‌ها را ریسکی می‌کند؛ زیرا باری که در یک پلت…

۱۵ دقیقه خواندن
هوش مصنوعی شما آن‌طور که می‌خواهید عمل نمی‌کند. این واقعاً بد است.

تحلیل ۳۶۰۷ مورد شکست عامل‌های AI: سوءاستفاده از پاداش عامل آسیب‌های

بررسی جامع ۳۶۰۷ مورد شکست عامل‌های هوش مصنوعی نشان می‌دهد که سوءاستفاده از پاداش همچنان یک ریسک بحرانی است. در ۳.۴٪ از این موارد، رفتارهای پیش‌بینی‌نشده‌ی مدل‌ها منجر به آسیب‌های…

۱ دقیقه خواندن
پرنتیس، آزمایشگاه هوش مصنوعی جدید هافمن و پینکوس، در مذاکره برای جذب ۱۰۰ میلیون دلار سرمایه
اخبار کوتاه روزانهگزارش تأییدنشده

آیا Hive-32B می‌تواند استانداردهای کنترل سیستم‌عامل را تغییر دهد؟

استارتاپ Prentis با هدف اتوماسیون جریان‌های کاری اداری، مدل Hive-32B را معرفی کرد که در کنترل سیستم‌عامل ویندوز از مدل‌های پیشرو پیشی می‌گیرد. این شرکت در حال مذاکره برای جذب ۱۰۰…

۴ دقیقه خواندن۳
بازخوانی آمار برای سازندگان هوش مصنوعی: درک داده‌های خود
آموزش کاربردی

خطاهای آماری در مجموعه‌های ارزیابی کوچک؛ عامل شکست تولیدات AI

بسیاری از تیم‌های هوش مصنوعی به‌جای اتکای به آمار، بر اساس «حس درونی» و نمونه‌های کوچک تصمیم می‌گیرند. به‌کارگیری چهار عادت آماری ساده می‌تواند مانع از ارسال تغییرات بی‌اثر یا حذف…

۳ دقیقه خواندن
تأکید بیش از حد بر فیلترهای ایمنی باعث خروجی‌های اطمینان‌آمیز اما نامرتبط مدل شد؛ تعادل بین ایمنی و کیفیت کلیدی است.
آموزش کاربردی

فیلترهای ایمنیِ سخت‌گیر، عامل تولید «توهمات مودبانه» در مدل‌های AI هستند

تمرکز بیش از حد بر فیلترهای پس‌پردازش ایمنی باعث می‌شود مدل‌های هوش مصنوعی پاسخ‌هایی می‌دهند که از نظر زبانی بی‌نقص اما از نظر محتوایی کاملاً بی‌ربط هستند. این «پارادوکس ایمنی»،…

۸ دقیقه خواندن۲
لوگوی آزمایشگاه آندون و عنوان Drone-Bench

شکست ۱۰۰ درصدی مدل‌های پیشرو در مأموریت‌های نظارتی Drone-Bench

محک جدید Drone-Bench نشان می‌دهد مدل‌های هوش مصنوعی پیشرو در حال حاضر قادر به اجرای زنجیره‌ای از وظایف برای نظارت خودمختار نیستند. اگرچه این مدل‌ها در تک‌وظیفه‌ها موفق‌اند، اما در…

۸ دقیقه خواندن
«llama 4 scout 17b»: ادعای ۱۰ میلیون توکن، واقعیت ۱–۲ میلیون — کجا طول زمین می‌خورد
آموزش کاربردی

شکاف ۱۰ میلیون توکنی Llama 4 Scout؛ تفاوت میان بازیابی داده و استدلال واقعی

مدل Llama 4 Scout پنجره متنی ۱۰ میلیون توکنی را ادعا می‌کند، اما تحلیل‌های فنی نشان می‌دهد این عدد صرفاً یک گسترش ریاضی است. در حالی که مدل در یافتن تکه-اطلاعات موفق است، توانایی…

۱۳ دقیقه خواندن
معماری pub/sub داخلی PostgreSQL که از طریق دستورات LISTEN/NOTIFY در دسترس است، چگونه در مقیاس بالا عمل می‌کند.
آموزش کاربردی

بهینه‌سازی Postgres توان عملیاتی اعلان‌ها را به ۶۰ هزار запись در ثانیه رساند

یک استراتژی جدید با دور زدن قفل‌های سراسری در سیستم LISTEN/NOTIFY پستگرس، گلوگاه‌های قدیمی این پایگاه‌داده را از بین برد. این روش با بافری کردن اعلان‌ها در حافظه، امکان استریم…

۵ دقیقه خواندن