
گوگل: چارچوب RRSI احتمال بیشبرازش را در عاملهای هوش مصنوعی کاهش داد
گوگل چارچوب RRSI را برای جلوگیری از بیشبرازش (Overfitting) در عاملهای هوش مصنوعی معرفی کرد. این سیستم با اعمال محدودیتهای منظمساز، اجازه میدهد عاملها بدون حفظ کردن پاسخهای…
موضوع
گزارشها و تحلیلهای مربوط به توانایی تکرار و تأیید نتایج پژوهشهای هوش مصنوعی
۲۳۴ مقاله منتشر شده

گوگل چارچوب RRSI را برای جلوگیری از بیشبرازش (Overfitting) در عاملهای هوش مصنوعی معرفی کرد. این سیستم با اعمال محدودیتهای منظمساز، اجازه میدهد عاملها بدون حفظ کردن پاسخهای…

استونی با همکاری شرکت Owkin، پلتفرم K Pro را در زیرساختهای امن ملی خود ادغام کرد تا پژوهشگران بتوانند بدون خروج دادهها از مرزهای کشور، تحلیلهای پزشکی در مقیاس جمعیت انجام دهند.

تستهای سنتی مبتنی بر تطابق دقیق متنی برای مدلهای زبانی ناکارآمد هستند زیرا پاسخهای درست میتوانند به شکلهای بیشماری بیان شوند. توسعهدهندگان باید از رویکرد لایهای ترکیبی،…

تغییر در پرامپتها یا شاخصهای بازیابی میتواند حتی بدون تغییر مدل، باعث فروپاشی سیستم شود. برای جلوگیری از این شکستها، جایگزینی نسخهبندی ساده با «مانیفست انتشار» (Release…

یک نمونهٔ اثباتی جدید، زنجیرهای قابلتأیید از توسعهٔ محلی هوش مصنوعی تا سوابق بلاکچین ایجاد کرده است. این سیستم با هش کردن دادههای دانش، پیوندی تغییرناپذیر میان فعالیتهای فنی…

معاملات حرفهای از ترمینالهای دادهٔ غیرفعال به سمت پلتفرمهای بومی هوش مصنوعی حرکت میکنند که اولویت را به سیگنالها و استدلال خودکار میدهند. این گذار فاصله میان رخدادهای بازار…

یک محک جدید نشان میدهد مدلهای هوش مصنوعی بهجای پذیرش نادانی، در ۷۰.۷٪ موارد دادههای مفقود را با مقادیر محتمل اما غلط جایگزین میکنند. اگرچه دستورات خاص نرخ خطا را به ۲۰.۲٪…

یک تحلیل انتقادی استدلال میکند که آزمایشگاههای پیشرو بهجای ساخت ابزارهای بهرهوری، محصولاتی با رابط کاربری فریبنده ساختهاند تا توهم توانمندی ایجاد کنند. نویسنده چارچوبی برای…

پروژه Glasshouse برای سنجش دقیق حافظه بلندمدت هوش مصنوعی طراحی شده، اما با وجود استقبال در گیتهاب، هیچ توسعهدهندهای آن را اجرا نکرده است. این اتفاق شکاف عمیق میان علاقه به…

یک نقص امنیتی در متادیتای پاسخهای عاملهای A2A کشف شد که با وجود پاس کردن ۵۸ تست داخلی، دادههای جعلی ارسال میکردند. این یافته منجر به بازبینی جامع مشخصات فنی (نسخه ۱.۴) و ابداع…

استفاده از مدلهای متفاوت برای ایندکسگذاری و پرسوجو، نتایج جستوجو را به نویز تبدیل میکند. این شکست بدون هیچ خطا یا هشدار سیستمی رخ میدهد و خطری جدی برای خط لولههای RAG است.

پژوهشی جدید نشان میدهد جملات سلب مسئولیت رایج در مدلهای زبانی، نه حاصل وزنهای داخلی مدل، بلکه نتیجهی قالبهای چت (Chat Templates) هستند. محققان با دستکاری بردارهای فعالسازی…