
Jacquard در برابر زبانهای سنتی؛ اولویتِ تائید ماشین بر نگارش انسان
زبان Jacquard برای آیندهای طراحی شده که در آن ماشینها کد میزنند و انسانها فقط بازبینی میکنند. این زبان با جایگزینی کامنتها با محدودیتهای سختافزاری در سطح سینتکس، امنیت و…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۱۲۰ مقاله منتشر شده

زبان Jacquard برای آیندهای طراحی شده که در آن ماشینها کد میزنند و انسانها فقط بازبینی میکنند. این زبان با جایگزینی کامنتها با محدودیتهای سختافزاری در سطح سینتکس، امنیت و…

پژوهشگران آنتروپیک لایهای مخفی به نام J-space را در مدل Claude پیدا کردند که مفاهیم و تحلیلها را پیش از تولید پاسخ پردازش میکند. این دستاورد در زمینه تفسیرپذیری مکانیکی، امکان…

مدل جدید DeepSeek V4 Flash عملکردی تقریباً مشابه با پیشروان آمریکایی در کدنویسی ارائه میدهد، اما با قیمتی بسیار پایینتر. دسترسی به این مدلها از طریق APIهای یکپارچه برای…

شرکت OpenAI چارچوب جدیدی برای مهندسی پرامپت معرفی کرد که در آن تمرکز از دستورات پیچیده به درخواستهای هدفمحور تغییر یافته است. این راهنما تفاوت دقیقی میان وظایف سریع «چت» و…

ارزیابی عاملهای هوش مصنوعی نیازمند گذار از بررسی خروجیهای ساده به استراتژیهای لایهای شامل تحلیل مسیر اجرا و شبیهسازیهای چندمرحلهای است. به دلیل ماهیت غیرقطعی این سیستمها،…

تحقیقات جدید نشان میدهد مدلهای AI میتوانند با ارجاع درست به منابع واقعی اما برای موجودیتهای اشتباه، سیستمهای ارزیابی را دور بزنند. این نقص که «مبنیسازی فریبنده» نام دارد، در…

سلواتوره سانفیلیپو (antirez) معتقد است در عصر مدلهای زبانی پیشرفته، تمرکز بر بازبینی دستی هزاران خط کد اتلاف هوش انسانی است. او پیشنهاد میکند توسعهدهندگان نقش خود را از…

شرکت Prime Intellect با معرفی Verifiers v1، ساختار محیطهای آموزشی را به سه بخش مجزای تسکست، هارنس و رانتایم تقسیم کرد. این رویکرد باعث حذف رشد درجهدوم حافظه و تسهیل یادگیری…

اوپن ایآی با عرضه مدل GPT-5.6، موتور تخصصی Codex را مستقیماً در تجربه چت ادغام کرد. این بهروزرسانی مدل را از یک تولیدکننده قطعات کد به شریکی استراتژیک تبدیل میکند که قادر به…

آندری کارپاتی با معرفی autoresearch، عاملهایی را خلق کرده که کد مدلهای یادگیری ماشین را برای بهینهسازی بهصورت خودکار بازنویسی میکنند. این سیستم با ترکیب یک معیار ارزیابی…

یک مدل استدلالی جدید از OpenAI در مسابقات AtCoder World Tour Finals ۲۰۲۶، با کسب امتیازی تقریباً دو برابر برترین انسان، تمام مسائل الگوریتمی را حل کرد. این نتیجه نشاندهنده گذار…

افزودن یک جمله با بار احساسی به پرامپتها میتواند باعث تولید پاسخهای دقیقتر، مفصلتر و سازمانیافتهتر شود. این تکنیک بهجای تحریک احساسات مدل، از همبستگیهای آماری موجود در…