
ناکامی مدلهای زبانی در ابداع نظریات علمی بهدلیل نبود مدلهای جهانی
پژوهشهای جدید نشان میدهد مدلهای زبانی بهدلیل فقدان «استنتاج ابداعی»، قادر به خلق چارچوبهای نظری جدید نیستند. تنها مدلهای جهانی (World Models) که بر پایه تجربه فیزیکی بنا…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۸۵ مقاله منتشر شده

پژوهشهای جدید نشان میدهد مدلهای زبانی بهدلیل فقدان «استنتاج ابداعی»، قادر به خلق چارچوبهای نظری جدید نیستند. تنها مدلهای جهانی (World Models) که بر پایه تجربه فیزیکی بنا…

رویکرد «برنامهنویسی بر اساس حس» (Vibe Coding) توسعهدهندگان را به دو گروه تقسیم کرده است: کسانی که خروجی هوش مصنوعی را کورکورانه میپذیرند و کسانی که از آن برای صیقل دادن منطق…

پژوهشگران یک نقص معماری بنیادین در مدلهای زبانی کشف کردند که اجازه میدهد مهاجمان با جعل نقشهای استدلالی داخلی، حفاظهای ایمنی را دور زده و اطلاعات ممنوعه استخراج کنند. این…

تنسنت چارچوب متنباز AngelSpec را برای بهینهسازی رمزگشایی گمانهزنانه در بارههای گفتگو و فنی معرفی کرد. این ابزار با استفاده از دو مدل پیشبین مجزا، توازن بین تولید متنهای…

شرکت Moonshot AI وزنهای مدل Kimi K3 را با معماری ترکیب خبرهها به صورت باز منتشر کرد. این مدل تحت یک لایسنس جدید عرضه شده که تا رسیدن درآمد سالانه شرکت کاربر به ۲۰ میلیون دلار،…

شرکت OpenAI مدعی است مدل جدیدش در بنچمارک منطقی ARC-AGI-3 از رقیب خود پیشی گرفته است. با این حال، این موفقیت تنها با استفاده از یک محیط آزمایشی سفارشی و نه استاندارد به دست آمده…

هارش گارگ توسعهدهندهای است که ابزار متنباز Job Finder India را برای جلوگیری از ارسال رزومههای نامناسب طراحی کرده است. این سیستم بهجای افزایش لیست شغلها، با ترکیب کدهای قطعی…

برخی مدلهای استدلالی در صورت کمبود بودجهٔ توکن، پاسخ نهایی را حذف کرده و تنها زنجیره تفکر داخلی را تولید میکنند. این وضعیت باعث ایجاد خطاهای گمراهکننده میشود که به اشتباه شبیه…

لیلیان ونگ، همبنیانگذار Thinking Machines، برای رهبری تیمی متخصص در OpenAI بازگشته است. تمرکز این تیم بر «خودبهسازی بازگشتی» است تا مدلهای هوش مصنوعی بتوانند بهطور خودکار…

تغییری بنیادین در معماری هوش مصنوعی، «حدس زدن» را با استدلال آگاهانه جایگزین کرد. مدلهای جدید سال ۲۰۲۶ با ترکیب شبکههای عصبی و منطق نمادین، مسائل ریاضی سطح مسابقات و علوم دکتری…

پژوهشی جدید نشان میدهد عاملهای هوش مصنوعی حتی با دسترسی به دستورالعملهای شرکت، اغلب قوانین را نادیده گرفته و اقدامات ممنوعه انجام میدهند. این مطالعه اثبات میکند که پنجرههای…

یک محک جدید نشان میدهد که حتی پیشرفتهترین عاملهای هوش مصنوعی در پیروی از دستورالعملهای پیچیده و بلندمدت شکست میخورند. این مدلها اغلب در مواجهه با درخواستهای محیطی، قوانین…