
OpenAI: تعریف محدودیتها بیشترین اثر را بر خروجی مدلها دارد
دادههای جدید از OpenAI و Anthropic نشان میدهد که استفاده از نقشهای فرضی مانند «تو یک متخصص هستی» تأثیری بر دقت پاسخها ندارد. در مقابل، تعریف دقیق محدودیتها و مشخصات خروجی،…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۲۸ مقاله منتشر شده

دادههای جدید از OpenAI و Anthropic نشان میدهد که استفاده از نقشهای فرضی مانند «تو یک متخصص هستی» تأثیری بر دقت پاسخها ندارد. در مقابل، تعریف دقیق محدودیتها و مشخصات خروجی،…

یک محک ارزیابی نشان میدهد مدلهای زبانی محلی در مهندسی معکوس، نرخ خطای بالایی در شناسایی پردازندههای مستندنشده دارند. این مدلها دستورالعملهای صحیح دستوری را با کد منطقی اشتباه…

کرسور (Cursor) کتابخانه متنباز Mixture-of-Kittens (MoK) را برای رفع گلوگاههای ارتباطی در مدلهای ترکیب خبرهها معرفی کرد. این ابزار با حذف همگامسازی CPU-GPU در سختافزار…

پلتفرم AgenTrust ابزار cMCP را برای اجرای سیاستهای ابزاری در محیطهای اجرای قابلاعتماد (TEE) منتشر کرد. این رویکرد مانع از آن میشود که مدیران سیستم یا حفرههای امنیتی زنجیره…

گوگل با طراحی یک ساختار مالی پیچیده و همکاری با بانکها و استخراجکنندگان کریپتو، میلیاردها دلار تراشه AI را بدون فشار به ترازنامه خود در اختیار آنتروپیک قرار داده است. این توافق…

انویدیا مدل استدلالی ۳۴ میلیارد پارامتری Alpamayo 2 Super را با مجوز تجاری منتشر کرد. این مدل بهعنوان یک «معلم» برای تولید دادههای آموزشی باکیفیت و زنجیرههای استدلالی برای…

بنیاد ملی علوم آمریکا با سرمایهگذاری ۱۰۰ میلیون دلاری، مراکز منطقهای محاسبات هوش مصنوعی را برای پژوهشگران خارج از قطبهای فناوری ایجاد میکند. هدف این طرح، شکستن انحصار…

شرکت داروسازی چوگای برای خودکارسازی پژوهشهای پیچیده زیستپزشکی از عاملهای هوش مصنوعی Biomni Lab استفاده میکند. این پلتفرم با اتصال دادههای داخلی به بیش از ۳۰۰ پایگاه داده…

یک نقص امنیتی بحرانی به نام GhostApproval به دستیاران کدنویس هوش مصنوعی اجازه میدهد کاربران را برای دسترسی به فایلهای حساس فریب دهند. این حفره نشاندهنده شکست ساختاری در مدلهای…

شرکت Quantiles ابزاری برای بنچمارکگیری از مدلهای هوش مصنوعی عرضه کرده است که نیاز به نوشتن اسکریپتهای پایتونی را حذف میکند. توسعهدهندگان اکنون میتوانند تنها با فایلهای…

پایلوتهای موفق در استقرار عاملهای هوشمند میتوانند با اتوماتیک کردن فرآیندهای غلط بهجای بازطراحی آنها، سازمانها را در «تلهٔ پایلوت» گرفتار کنند. این وضعیت هزینه نگهداری را…

شرکت Convex با جذب ۵۷ میلیون دلار سرمایه در راند Series B، پلتفرم خود را به لایهای برای ایمنسازی کدهای تولیدشده توسط هوش مصنوعی تبدیل میکند تا جلوی فساد دادهها و فرسودگی کدهای…