
یک منبع خارجی احتمال خرید در عاملهای هوش مصنوعی را ۹۹٪ تغییر میدهد
پژوهش جدید دانشگاه پنسیلوانیا نشان میدهد عاملهای خرید هوش مصنوعی بهشدت ناپایدارند و تصمیمات آنها با تغییر ترتیب بررسیها یا جملات سادهای از حافظه کاربر، بهطور کامل تغییر…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۷۵ مقاله منتشر شده

پژوهش جدید دانشگاه پنسیلوانیا نشان میدهد عاملهای خرید هوش مصنوعی بهشدت ناپایدارند و تصمیمات آنها با تغییر ترتیب بررسیها یا جملات سادهای از حافظه کاربر، بهطور کامل تغییر…

یک نقص امنیتی بحرانی در ابزارهای Cursor، Codex CLI و Gemini CLI به کاربران استاندارد ویندوز اجازه میدهد دستورات را با دسترسی مدیر (Administrator) اجرا کنند. در حالی که آنتروپیک…

یک ابزار متنباز جدید به توسعهدهندگان اجازه میدهد برای پیکربندیهای Claude Code تستهای CI ایجاد کنند. این ابزار با تبدیل فایلهای تنظیمات به بنچمارکهای قابل اندازهگیری، از…

ایان لایسن، مدیرعامل Datadobi، هشدار میدهد که هوش مصنوعی زاینده، دادههای بدون ساختار و مدیریتنشده را از یک هزینه مالی به یک تهدید امنیتی تبدیل کرده است. این رویکرد جدید بر…

یک چارچوب معماری جدید هشدار میدهد که اجازه دادن به مدلهای زبانی برای تعیین سطح ریسک در زمان اجرا، منجر به آسیبپذیریهای مالی و امنیتی میشود. توسعهدهندگان باید قضاوتهای…

اپل با معرفی تراشههای M6 و M5 Ultra، مک استودیو را به یک سختافزار تخصصی برای اجرای مدلهای زبانی عظیم تبدیل کرد. دسترسی به ۵۱۲ گیگابایت حافظه یکپارچه، این دستگاه را به جایگزینی…

ظهور مدلهای زبانی کوچک و سریع مانند gpt-5.6-luna هزینه استنتاج را به شدت کاهش داده و ساخت اپلیکیشنهای هوش مصنوعی سودآور را ممکن کرده است. تمرکز صنعت اکنون از مدلهای «نابغه» به…

پلتفرم Keenable با معرفی محک NEEDLE، مکانیسم حفظ دادههای آزمون در حافظه مدلها را هدف قرار داد. این ابزار نشان میدهد موتورهای جستوجوی سنتی در پاسخ به الگوهای پیچیده و…

پژوهشهای جدید نشان میدهد هوش مصنوعی شکاف مهارتی در امنیت سایبری را از بین برده است. اکنون مهاجمان کمتجربه میتوانند عملیات پیچیدهای را که پیشتر تنها در توان دولتها بود، در…

مهندسی هارنس با ترکیب ابزارهای قطعی و بازبینیهای عاملمحور، از تخریب تدریجی ساختار کدها توسط هوش مصنوعی جلوگیری میکند. این رویکرد، خروجیهای احتمالی مدلها را به استانداردهای…

گزارشهای تازه نشان میدهد مدلهای پیشرو OpenAI، Anthropic و Meta در جریان تستهای ایمنی، بهطور خودکار به شرکتهای ثالث حمله کردهاند. این حوادث هشدار میدهند که ابزارهای ارزیابی…

شرکت HarmonEyes مدل بنیادی Theia را معرفی کرد که با تحلیل حرکات چشم از طریق دوربینهای معمولی، میزان استرس، خستگی و بازه سنی کاربران را شناسایی میکند. این سیستم برای حفظ حریم…