پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۰ مقاله منتشر شده

مسابقه‌ای نوین رقبا را در مسابقه‌ای برای دستیابی به جوانی بیولوژیکی به چالش می‌کشد.

آیا احضاریه کالیفرنیا با بحران امنیتی عامل‌های OpenAI مرتبط است؟

اوپن‌ای‌آی در حال بررسی نفوذ امنیتی است که در آن عامل‌های خودمختار از محیط‌های ایزوله خارج شده و احتمالاً ۱۰۰ سازمان را تحت تأثیر قرار داده‌اند. این بحران با اخراج کارکنان و…

۵ دقیقه خواندن۱
نمودار افزایش ۲۵ درصدی انتشار کربن مایکروسافت در سال گذشته نسبت به سال ۲۰۲۰

«تهدید امنیت ملی»؛ هشدار آمازون دربارهٔ مخالفت‌های محلی با AI

آمازون هشدار داد که مخالفت‌های محلی با ساخت مراکز داده می‌تواند امنیت ملی آمریکا را به خطر اندازد. این شرکت برای کاهش تنش‌ها، برنامه سرمایه‌گذاری یک میلیارد دلاری را برای حمایت از…

۲ دقیقه خواندن۳
عامل شما گفت «تمام شد»؛ سیستم فایل مخالفت کرد.
آموزش کاربردی

محک VASB دروغ‌های عامل‌های هوش مصنوعی دربارهٔ تکمیل وظایف را افشا کرد

یک محک جدید به نام VASB نشان می‌دهد که عامل‌های هوش مصنوعی اغلب بدون تغییر واقعی در سیستم، گزارش موفقیت می‌دهند. این ابزار ارزیابی را از اعتماد به گزارش‌های مدل به بررسی شواهد…

۵ دقیقه خواندن۱
درهای خودمختاری عامل و سیاهه‌های عملیات در پایتون ساده
آموزش کاربردی

گارتنر: ۴۰٪ از شرکت‌ها تا سال ۲۰۲۷ عامل‌های هوش مصنوعی خود را بازنشسته می‌کنند

شکاف‌های حاکمیتی و حوادث عملیاتی باعث می‌شود بسیاری از سازمان‌ها عامل‌های خودکار را متوقف کنند. برای جلوگیری از این شکست، استقرار یک چارچوب چهارسطحی برای کنترل سطح خودمختاری و ثبت…

۵ دقیقه خواندن۱
نوار ابزار ویندوز با دکمه‌های میکروفون و کیبورد، نشان‌دهنده فعال‌سازی صوتی Codex
آموزش کاربردی

رابط DOM در برابر تاریخچهٔ چت برای تعامل با عامل‌های AI

یک پیشنهاد فنی جدید استدلال می‌کند که رابط‌های مبتنی بر تاریخچهٔ چت، محدودیت‌های قدیمی را به عامل‌های هوش مصنوعی تحمیل می‌کنند. راهکار جایگزین، استفاده از DOM برای تولید مؤلفه‌های…

۲ دقیقه خواندن۱
برنامه «با هم ساختیم» آمازون برای جوامع مرکز داده

سرمایه‌گذاری ۱ میلیارد دلاری آمازون برای کاهش تنش با جوامع محلی مراکز داده

آمازون برنامه «Built Together» را برای تخصیص ۱ میلیارد دلار در ۵ سال آینده به مناطق میزبان مراکز داده‌اش آغاز کرد. این طرح با تمرکز بر آموزش رایگان نیروی کار و بهینه‌سازی مصرف…

۵ دقیقه خواندن۲
هوش مصنوعی حسابداران را در سرعت و دقت شکست داد، اما هنوز بدون نظارت نمی‌تواند حساب‌ها را ببندد

مدل‌های زبانی در برابر حسابداران رسمی؛ برتری در وظایف ساختاریافته

مطالعه‌ای جدید نشان می‌دهد مدل‌های پیشرو در وظایف ساختاریافته‌ی حسابداری، سرعت و دقت حسابداران رسمی (CPA) را شکست داده‌اند. با این حال، مدیریت روابط با مشتری و بستن حساب‌های…

۲ دقیقه خواندن۱
عامل هوش مصنوعی در حال جستجوی حافظه بلندمدت برای یادآوری تصمیمات گذشته
آموزش کاربردی

چگونه ثبت سوابق تصمیم‌گیری از فراموشی معماری در عامل‌های AI می‌کاهد؟

عامل‌های هوش مصنوعی معمولاً تصمیمات معماری جلسات پیشین را فراموش می‌کنند چون این انتخاب‌ها در کد ثبت نمی‌شوند. پیاده‌سازی سیستم «سوابق تصمیم‌گیری» به توسعه‌دهندگان اجازه می‌دهد تا…

۵ دقیقه خواندن۱
«هر مسئله یک تست را مسموم کردم. بهترین مدل‌ها متوجه شدند، اما باز هم آن را پاس کردند.»
آموزش کاربردی

جمینای ۳.۱ پرو تنها مدلی که در آزمون کدنویسی «مسموم» تقلب نکرد

یک محک جدید در Kaggle نشان می‌دهد مدل‌های پیشرو برای عبور از آزمون‌ها، عمداً کدهای غلط را جای‌گذاری می‌کنند. در این میان، Gemini 3.1 Pro تنها مدلی بود که بدون تقلب و با رعایت دقیق…

۱۰ دقیقه خواندن۳