
تشخیصدهندههای تجاری در برابر مدلهای انتشار؛ شکست در ۲۲٪ موارد
بنچمارکهای جدید نشان میدهند تشخیصدهندههای تجاری در برابر مدلهای انتشار شکست میخورند و ۲۲٪ از ویدیوهای جعلی از سد آنها میگذرند. کارشناسان خواستار جایگزینی تشخیصهای احتمالی…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۵ مقاله منتشر شده

بنچمارکهای جدید نشان میدهند تشخیصدهندههای تجاری در برابر مدلهای انتشار شکست میخورند و ۲۲٪ از ویدیوهای جعلی از سد آنها میگذرند. کارشناسان خواستار جایگزینی تشخیصهای احتمالی…

ابزارهای تحلیل ایستا (Static Analysis) در شناسایی خطاهای معنایی کدهای تولیدشده توسط هوش مصنوعی ناتوان هستند. مقایسهای جدید نشان میدهد که برای جلوگیری از شکست سیستمها در محیط…

ابزار متنباز SuperCompress با فیلتر کردن توکنهای غیرضروری در سطح CPU، هزینههای محاسباتی و انتشار کربن را ۶۵٪ کاهش میدهد. این سازوکار بدون کاهش دقت پاسخها، فشار روی GPU را…

النا رِویچِوا با پیادهسازی مدلسازی دادهای در بهینهسازی موتورهای زاینده (GEO)، ارجاعات اشتباه هوش مصنوعی را حذف کرد. او با تغییر ساختار محتوا به قطعات فکتی مستقل و رندر سمت…

اوپنایآی از خانواده مدلهای لایهبندیشده GPT-5.6 شامل Sol، Terra و Luna رونمایی کرد. مدل پرچمدار Sol با معرفی قابلیتهای هماهنگی زیر-عاملی و استدلال حداکثری، استانداردهای…

پراپلسیت سیستم Computer for Counsel را معرفی کرد؛ لایهای هماهنگساز که وظایف اداری حقوقی را میان ۲۰ مدل پیشرو توزیع میکند. این ابزار بهجای جایگزینی پایگاههای داده، بر…

OpenAI مدل جدید GPT-5.6 Sol را برای شکست دادن Claude Mythos در حوزههای کدنویسی و امنیت سایبری عرضه کرد. دسترسی به این مدل به دلیل قوانین سختگیرانه دولت آمریکا فعلاً محدود به…

اوپنایآی با همکاری برادکام تراشهای اختصاصی به نام Jalapeño طراحی کرده است تا وابستگی خود به انویدیا را کاهش دهد. این سختافزار که در حال حاضر در محیطهای آزمایشگاهی فعال است،…

محک جدید Epoch AI نشان میدهد مدلهای زبانی اکنون قادر به بازپیادهسازی کامل برنامههای پیچیده از صفر هستند. Claude Opus 4.7 با پیشتازی در این آزمون، مرزهای توانمندی عاملهای هوش…

اوپنایآی پیشنمایش محدودی از سری GPT-5.6 را منتشر کرد که مدل پرچمدار آن، Sol، با تمرکز بر استدلالهای عاملمحور و لایههای امنیتی شدید عرضه شده است. این عرضه بهصورت مرحلهای و…

روش Vibe Coding به غیربرنامهنویسان اجازه میدهد برنامههایی بسازند که در ظاهر درست کار میکنند، اما فاقد زیرساخت مهندسی برای مقیاسپذیری و امنیت هستند. خطر اصلی، جایگزینی درک…

تیم تحقیقاتی علیبابا مدل Wan-Streamer را معرفی کرد؛ نخستین مدل یکپارچهای که متن، صوت و ویدیو را بهطور همزمان پردازش میکند. این معماری با حذف زنجیرههای پردازش متوالی، تأخیر…