
فایلهای دستورالعمل حجیم باعث کاهش توجه عاملهای هوش مصنوعی میشوند
بارگذاری بیش از حد دستورالعملها در فایلهای مرکزی باعث ایجاد «پوسیدگی زمینه» و تضعیف تمرکز مدل میشود. راهکار جایگزین، افشای تدریجی است؛ یعنی بارگذاری قوانین خاص تنها در لحظه…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۱۵ مقاله منتشر شده

بارگذاری بیش از حد دستورالعملها در فایلهای مرکزی باعث ایجاد «پوسیدگی زمینه» و تضعیف تمرکز مدل میشود. راهکار جایگزین، افشای تدریجی است؛ یعنی بارگذاری قوانین خاص تنها در لحظه…

پروژه Vibebase با پیادهسازی پروتکل SAL قصد دارد مدیریت هویت عاملهای هوش مصنوعی را از فضای تئوری به کد عملی تبدیل کند. هدف این است که عاملها بدون وابستگی به سیستمهای احراز هویت…

تیم ZGCM مدل ۷ میلیارد پارامتری ZGCM-1 را منتشر کرد که در استدلال ریاضی و جستوجوی عاملمحور از مدلهای غولپیکر پیشی میگیرد. این مدل با استفاده از رویکرد «تحقیق و توسعه هوش…

عاملهای مبتنی بر یادگیری تقویتی با بهینهسازی پاداشهای بلندمدت و تعدیلشده بر اساس ریسک، مدلهای پیشبینی قیمت را کنار میزنند. این رویکرد اجازه میدهد سیستمها هزینههای تراکنش…

انویدیا با معرفی سیستم Vera Rubin NVL72، سقف عملکرد استنتاج در مدلهای بینایی-زبانی را جابهجا کرد. این جهش خیرهکننده نتیجهی رویکرد «طراحی مشترک سختافزار و نرمافزار» برای کاهش…

شرکت نوو نوردیسک برای تسریع در کشف داروهای بیماریهای مزمن، سامانه Claude Science و مدلهای پیشرو آنتروپیک را به چرخه تحقیق و توسعه خود اضافه کرد. این همکاری پس از موفقیت پلتفرم…

شرکتهای Cohere و Aleph Alpha برای تشکیل یک نهاد جهانی با مقر مشترک در برلین و تورنتو ادغام شدند. این اتحاد هدفش ارائه راهکارهای هوش مصنوعی حاکمیتی برای دولتها و صنایع تحت نظارت…

گوگل دیپمایند مؤسسه DeepMind Institute (DMI) را برای مطالعه ایمنی و حکمرانی هوش مصنوعی عمومی (AGI) راهاندازی کرد. این مرکز با ترکیب تخصصهای فنی و علوم انسانی تلاش میکند تا…

پرامپتهای عمومی در صنایع با حجم عملیاتی بالا شکست خوردهاند. معماریهای جدید با جایگزینی گفتگو با مسیریابی قطعی (Deterministic Routing) و اتصال مستقیم به سیستمهای عملیاتی،…

عاملهای کدنویس با تولید همزمان کد و دادههای آزمون بر اساس یک برداشت اشتباه، نرمافزارهای «سازگار اما غلط» میسازند. رویکرد جدید مدلمحور با جداسازی دنیای آزمون از کد، این…

انویدیا، گوگل و Emerald AI با تشکیل اتحادیه AEMA قصد دارند مراکز دادهای بسازند که مصرف برق خود را بر اساس فشار شبکه تغییر دهند. این استراتژی برای دور زدن صفهای ۵ تا ۷ ساله اتصال…

مدل DeepSeek V4.1 Flash در یک محک سختگیرانه، با نمره کامل ۱۱ از ۱۱ تمام اهداف آسیبپذیر را مورد نفوذ قرار داد. این مدل با بهرهگیری از حافظه پنهان ورودی، کل این عملیات پیچیده را…