پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۸۳ مقاله منتشر شده

AI

حلقه ارزیابی: قطعه گم‌شده‌ای در معماری AI که مانع از کشف علم می‌شود

ریچارد ساتون، برنده جایزه تورینگ، معتقد است مدل‌های زبانی فعلی به دلیل نبود «حلقه ارزیابی» قادر به اکتشاف علمی نیستند. این مدل‌ها در تقلید عالی‌اند، اما برای کشف حقیقت به سیستمی…

۲ دقیقه خواندن
AI

چرا جایگزینی پشتیبانی انسانی با هوش مصنوعی در متا یک کابوس امنیتی شد؟

هکرهای حرفه‌ای با سوءاستفاده از یک نقص امنیتی در چت‌بات پشتیبانی متا، حساب‌های سطح بالای اینستاگرام از جمله صفحه کاخ سفید اوباما را سرقت کردند. این حمله با دور زدن احراز هویت دو…

۲ دقیقه خواندن
AI

بنچمارک CVE-Bench: نرخ موفقیت GPT-5.5 در رفع آسیب‌پذیری‌های امنیتی ۵۰٪ است

مدل‌های پیشرو همچنان در رفع نیمی از آسیب‌پذیری‌های امنیتی واقعی ناتوان‌اند. بنچمارک CVE-Bench نشان می‌دهد که «استدلال امنیتی» در این مدل‌ها بیشتر شبیه به تطبیق الگو است تا تحلیل…

۲ دقیقه خواندن
AI

چگونه GPT-Rosalind سرعت شناسایی ویروس‌های جدید را برای دولت‌ها افزایش می‌دهد؟

شرکت OpenAI دسترسی رایگان به مدل تخصصی علوم زیستی خود، GPT-Rosalind را برای شرکای دولتی و غیرانتفاعی تأییدشده فراهم کرد. هدف این برنامه تسریع در تولید واکسن و ایجاد سامانه‌های…

۲ دقیقه خواندن
AI
آموزش کاربردی

داده‌های متا: ۹۲.۷٪ از قضایای ریاضی در ATLAS با موفقیت اثبات شدند

متا کتابخانه ATLAS را منتشر کرد؛ مجموعه‌ای عظیم از متون ریاضی که توسط هوش مصنوعی به کد Lean 4 تبدیل شده‌اند. این پایگاه داده با بیش از ۴۶ هزار قضیه اثبات‌شده، زیربنایی مقیاس‌پذیر…

۲ دقیقه خواندن۲
AI

چگونه «هارنس» یا محیط ارزیابی، توانایی واقعی مدل‌های پیشرو را بازتعریف می‌کند؟

شرکت OpenAI در یک دستورالعمل فنی استدلال می‌کند که توانایی مدل‌های پیشرو یک مقدار ثابت نیست، بلکه متغیری وابسته به «هارنس» (Harness) یا همان محیط، ابزارها و بودجه محاسباتی است.…

۳ دقیقه خواندن۲
AI

CogCAPTCHA30 و شکاف فرآیندی: چرا مدل‌های پیشرو در استدلال کمتر شبیه انسان هستند؟

پژوهشی جدید با معرفی «تست تورینگ فرآیندی» نشان می‌دهد که مدل‌های پیشرو با وجود ارائه پاسخ‌های صحیح، مسیری کاملاً متفاوت از انسان برای رسیدن به جواب طی می‌کنند. این مطالعه فاش…

۳ دقیقه خواندن۲
AI

چرا XCENA برای کاهش هزینه‌های استنتاج، محاسبات را به درون حافظه منتقل می‌کند؟

استارتاپ XCENA با جذب ۱۳۵ میلیون دلار سرمایه، تراشه‌ی MX1 را برای حذف گلوگاه حافظه در هوش مصنوعی توسعه می‌دهد. این فناوری با انتقال پردازش به درون ماژول‌های حافظه، تعداد سرورهای…

۲ دقیقه خواندن۳
AI

چرا وزن‌های مدل، گلوگاه واقعی عامل‌های هوش مصنوعی نیستند؟

پژوهشگران استنفورد و متا استدلال می‌کنند که عامل‌های هوش مصنوعی تنها یک مدل زبانی نیستند، بلکه ترکیبی از مدل و یک «هارنس» نرم‌افزاری‌اند. این لایه‌ی کد اجرایی است که تداوم وضعیت،…

۳ دقیقه خواندن۲