پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۸۰۵ مقاله منتشر شده

عامل سطح سیستم‌عامل اوپن‌ای‌آی: فراتر از چت‌باکس، با چالش متن ساده

OpenAI تاریخچه فعالیت کاربران مک را به‌صورت متن ساده و رمزنگاری‌نشده ذخیره

قابلیت جدید Computer History در اپلیکیشن مکِ OpenAI، تمام کلیک‌ها و تایپ‌های کاربر را برای ایجاد زمینه (Context) برای عامل‌ها ثبت می‌کند. اما ذخیره‌سازی این داده‌ها در فایل‌های…

۴ دقیقه خواندن۲
همه ۶۰٪ در هزینه‌های LLM صرفه‌جویی می‌کنند. اما هیچ‌کس آمار واقعی را نشان نمی‌دهد.
آموزش کاربردی

OmnisBench: ابزاری برای افشای واقعیتِ صرفه‌جویی در مسیریابی مدل‌های زبانی

پلتفرم Fortitude Omnis ابزار متن‌باز OmnisBench را برای اعتبارسنجی ادعاهای کاهش هزینه در مسیریابی LLMها منتشر کرد. این ابزار نشان می‌دهد بخش بزرگی از صرفه‌جویی‌های ادعایی، نه به…

۴ دقیقه خواندن۳
آنتروپیک: هر آزمایشگاهی می‌تواند عامل زبانی را برای طراحی پروتئین به کار گیرد

چرا نرخ موفقیت Claude در طراحی پروتئین از استانداردهای فعلی پیشی گرفت؟

آنتروپیک نشان داد که عامل‌های هوش مصنوعی می‌توانند کل زنجیره طراحی پروتئین را به‌صورت خودگردان مدیریت کنند. این مدل‌ها با نرخ موفقیت ۲۶.۸ درصدی، استانداردهای صنعتی (۱۰ تا ۱۵ درصد)…

۶ دقیقه خواندن۲
آزمایشگاه‌های هوش مصنوعی در کنترل سیستم‌های خود ناکام هستند

گزارش Guidelight: هیچ‌یک از آزمایشگاه‌های بزرگ AI استانداردهای ایمنی داخلی را

ارزیابی جدید سازمان غیرانتفاعی Guidelight نشان می‌دهد غول‌های هوش مصنوعی از جمله گوگل و OpenAI در پیاده‌سازی ابتدایی‌ترین اقدامات کنترلی برای سیستم‌های داخلی خود شکست خورده‌اند.…

۱ دقیقه خواندن۲
چین اجازه ورود محدود تراشه‌های H200 انویدیا را برای کمک به شرکت‌های هوش مصنوعی داد

تراشه‌های H200 انویدیا در برابر مدل‌های داخلی چین؛ ضرورت استنتاج

پکن برای جلوگیری از عقب‌ماندن از آمریکا، اجازه ورود محدود تراشه‌های H200 انویدیا را به غول‌های فناوری چین داد. با وجود پیشرفت مدل‌های داخلی، کمبود شدید ظرفیت استنتاج، چین را به…

۱ دقیقه خواندن۱
پالو آلتو نتورکز از آنتروپیک، اوپن‌ای‌آی و سازندگان تجهیزات صنعتی برای حفاظت زیرساخت‌های حیاتی کمک گرفت

پالو آلتو نتورکس پنجرهٔ آسیب‌پذیری هوش مصنوعی را با «وصله مجازی» به صفر رساند

پالو آلتو نتورکس با همکاری OpenAI و Anthropic سامانه‌ای برای حفاظت از زیرساخت‌های حیاتی در برابر حملات خودکار AI راه‌اندازی کرد. این سیستم با استفاده از «وصله مجازی»، اکسپلویت‌ها…

۴ دقیقه خواندن
برچسب‌زنی ۳۰۰ فراخوانی خراب ابزار LLM: ارسال مستقیم به طرح، ۲۹۰ مورد را با شکست مواجه می‌کند
آموزش کاربردی

محک TOOLCALL-300: نرخ شکست ۹۶.۷ درصدی مدل‌های زبانی در فراخوانی ابزارها

یک محک جدید نشان می‌دهد ارسال مستقیم خروجی‌های مدل‌های زبانی به سرورها، در ۹۶.۷٪ مواردِ بروز خطا در ساختار، منجر به شکست عملیاتی می‌شود. مجموعه TOOLCALL-300 روشی دقیق برای شناسایی…

۵ دقیقه خواندن۴
هفت سرویس MCP از آپلود فایل پشتیبانی می‌کنند. این‌ها واقعاً کار می‌کنند.
آموزش کاربردی

شکست پروتکل MCP در انتقال فایل؛ هیچ‌یک از ۷ سرویس برتر پشتیبانی بومی ندارند

یک بازرسی فنی نشان می‌دهد پروتکل زمینهٔ مدل (MCP) فاقد سازوکار بومی برای آپلود فایل است و توسعه‌دهندگان را مجبور به استفاده از راهکارهای ناپایدار می‌کند. با وجود اینکه APIهای…

۷ دقیقه خواندن۱
نمودار خطی ساده با عنوان «gralhix #004» که روند نزولی-صعودی را در محورهای خالی نشان می‌دهد.
آموزش کاربردی

استخراج مختصات جزیره‌ای ناشناخته با پردازش ۸۰ میلیون ترکیب هندسی در CUDA

یک توسعه‌دهنده با ساخت موتور جست‌وجوی هندسی سفارشی و پردازش ۸۰ میلیون ترکیب زمینی توسط GPU، موفق شد مکانی را پیدا کند که ابزارهای جست‌وجوی تصویری قادر به شناسایی آن نبودند. این…

۱۱ دقیقه خواندن۱
خودبهبودی بازگشتی هوش مصنوعی شاید آن‌قدرها هم سریع نباشد.

مطالعه MIT: فقدان خلاقیت در عامل‌های هوش مصنوعی مانع خودبهبودی مدل‌ها شد

پژوهشی جدید نشان می‌دهد هوش مصنوعی هنوز توانایی انجام تحقیقات باز و اکتشافی برای بهبود خود بدون کمک انسان را ندارد. این یافته، وعده‌های جسورانه صنعت درباره تکامل خودکار و سریع…

۴ دقیقه خواندن۳