
مدل Claude در ۱۴ مورد از ۱۵ هدف، پروتئینهای فعال زیستی طراحی کرد
مدلهای آنتروپیک با نرخ موفقیتی بسیار فراتر از استانداردهای صنعتی، موفق به طراحی پروتئینهای پیونددهنده شدند. این پیشرفت بر پایه یک سیستم تأیید آزمایشگاهی است که ثابت میکند…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۲ مقاله منتشر شده

مدلهای آنتروپیک با نرخ موفقیتی بسیار فراتر از استانداردهای صنعتی، موفق به طراحی پروتئینهای پیونددهنده شدند. این پیشرفت بر پایه یک سیستم تأیید آزمایشگاهی است که ثابت میکند…

یک محک جدید نشان میدهد مدلهای پیشرو هوش مصنوعی در استخراج ایدههای پژوهشی از کتابشناسیها بهشدت ناتواناند. حتی با استفاده از سامانههای چندعاملی، نرخ موفقیت به ۴۲٪ میرسد که…

هوش مصنوعی عاملمحور با افزودن استقلال، برنامهریزی و توانایی استفاده از ابزار، از مدلهای زاینده فراتر رفته است. این تحول اجازه میدهد سیستمها بهجای پاسخ به پرامپتها، کل…

یک مدل استدلالی جدید و ناشناس به نام Ox Alpha در پلتفرم OpenRouter ظاهر شده که توجه مدیرعامل Stripe را جلب کرده است. جامعه هوش مصنوعی اکنون میان دو فرضیه حضور یک پروژه مخفی…

شرکت Harvey پیشنمایش پژوهشی مدل Tenet را معرفی کرد که با بهینهسازی روی Kimi K3 و استفاده از یادگیری تقویتی، توانایی عاملهای هوش مصنوعی در مدیریت پروندههای پیچیده حقوقی را دو…

پلتفرم Zyctra ابزاری تخصصی برای پزشکان و متخصصان سلامت عرضه کرد که رزومهها را مطابق با استانداردهای سختگیرانه سیستمهای ATS بازنویسی میکند. این سرویس با استفاده از حافظه…

یک مهندس امنیت با زنجیرهسازی چهار مدل پیشرو، موفق شد یک تبلت Amazon Fire HD 10 را روت کند. این تجربه شکاف عمیق میان حفاظهای سختگیرانه مدلهای آمریکایی و قابلیتهای عاملمحور…

بررسی ۱۴٬۴۰۰ مورد نشان میدهد حذف قوانین متضاد، بهینهترین راه برای کاهش خطای پرامپت است. این استراتژی ساده، دقتی مشابه با اصلاحات پیچیده دارد اما هزینهی توکنها را بهشدت کاهش…

تحلیلی جدید نشان میدهد اجبار عاملهای هوش مصنوعی به مواجهه با خطاهای صریح در فراخوانی ابزارها، شکستهای «ساکت» را بهشدت کاهش میدهد. این رویکرد به توسعهدهندگان اجازه میدهد…

توسعه هوش مصنوعی از دستورات دستی به سمت «مهندسی حلقه» و «مهندسی گراف» حرکت میکند تا عاملها بتوانند اهداف پیچیده را در چرخههای خودکار اجرا کنند. این تغییر اجازه میدهد مدلها…

آنتروپیک با معرفی حالت Auto در Claude Code، تاییدات دستی را با یک مدل طبقهبندی جایگزین کرد تا عاملهای مهندسی بتوانند ساعتها بدون توقف کار کنند. یک مهندس Nuro با این قابلیت…

مدلهای زبانی بزرگ بهجای اجرای محاسبات قطعی، به دنبال تکمیل الگوهای متنی هستند. این نقص ساختاری در کنار توکنسازی که ارزش مکانی اعداد را از بین میبرد، باعث تولید پاسخهای…