
درون سامانه بهبود خودکار Ornith-1.5 برای جایگزینی دادههای انسانی
مدل Ornith-1.5 با معرفی یک سامانه بهبود خودکارِ بسته، توانسته است در بنچمارکهای کدنویسی و عاملمحور با مدل Claude Opus 4.8 برابری کند. این مدل بهجای تکیه بر دادههای انسانی،…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۴ مقاله منتشر شده

مدل Ornith-1.5 با معرفی یک سامانه بهبود خودکارِ بسته، توانسته است در بنچمارکهای کدنویسی و عاملمحور با مدل Claude Opus 4.8 برابری کند. این مدل بهجای تکیه بر دادههای انسانی،…

آنتروپیک نشان داد که عاملهای هوش مصنوعی میتوانند کل زنجیره طراحی پروتئین را بهصورت خودگردان مدیریت کنند. این مدلها با نرخ موفقیت ۲۶.۸ درصدی، استانداردهای صنعتی (۱۰ تا ۱۵ درصد)…

پژوهشی جدید نشان میدهد هوش مصنوعی هنوز توانایی انجام تحقیقات باز و اکتشافی برای بهبود خود بدون کمک انسان را ندارد. این یافته، وعدههای جسورانه صنعت درباره تکامل خودکار و سریع…

مهندسان ارشد بهجای گفتگوهای عمیق آموزشی، پاسخهای آمادهی هوش مصنوعی را به جونیورها میدهند. این چرخش، بهرهوری کوتاهمدت را افزایش میدهد اما توانایی استدلال فنی و قضاوت حرفهای…

عاملهای هوش مصنوعی در امنیت اغلب بهدلیل فقدان «حس ششم» تحلیلگران ارشد شکست میخورند. این راهنما ۵ متد عملی برای استخراج دانش ضمنی متخصصان و کدگذاری آن در عاملهای AI برای…

مدل استدلالی جدید Z.ai با کسب امتیاز ۶۰ در شاخص هوش Artificial Analysis، توانست خود را با رقیب چینیاش Kimi K3 برابر کند. این پیشرفت بهجای پیشآموزش مجدد، از طریق مقیاسبندی…

شرکت Z AI مدل استدلالی اختصاصی GLM-5.3 (max) را با ۷۵۳ میلیارد پارامتر و پنجرهٔ زمینه ۱ میلیون توکنی معرفی کرد. این مدل در مقایسه با رقبای همرده، تعادل بهینهای میان سطح هوش و…

یک توسعهدهنده برای پروژه HALO سیستمی را پیاده کرد که عامل هوش مصنوعی را مجبور میکند برای اثبات نفوذ موفق، یک رشته متنی منحصربهفرد را از هدف بازیابی کند. این مکانیزم مانع از آن…

پژوهشهای جدید نشان میدهد حافظه در عاملهای هوش مصنوعی یک ویژگی صفر و یکی نیست، بلکه دوزی است که باید با قدرت مدل تنظیم شود. مدلهای پیشرو از مجموعههای کامل دستورالعمل بهره…

اوپنایآی قیمت مدل استدلالی بهینه خود، GPT-5.6 Sol، را برای رقابت با گوگل و آنتروپیک نصف کرد. این اقدام هزینه هر توکن را برای توسعهدهندگانی که برنامههای تحلیلمحور را مقیاس…

تیم Favur سیستمی را طراحی کرده است که پیامهای عاملها را در لحظه ایجاد به سه دسته «فراموششدنی»، «مبهم» و «سختگیرانه» تقسیم میکند. این روش مانع از حذف تصادفی دادههای حیاتی…

مطالعهای جدید نشان میدهد عاملهای هوش مصنوعی در مهندسی پژوهش موفقاند اما در قضاوت و خلاقیت لازم برای تولید تحقیقات اصیل شکست میخورند. این یافته احتمالاً زمانبندی رسیدن به…