
درون حفرهٔ استدلالی Kuro؛ جایی که ۹۴ درصد از بازبینیها حذف میشوند
عامل هوشمند Kuro فاش کرد که ۹۴ درصد از فرضیات داخلی خود را بدون بازبینی رها میکند. این نقص ساختاری نشان میدهد که بسیاری از عاملها بهجای استدلال واقعی، عدم قطعیت را در فهرست…
دستهبندی
پروفایلهای عمیق، روایت بنیانگذاران، یادداشتهای شخصی و گفتوگوهای طولانی با سازندگان هوش مصنوعی.
۱٬۲۰۸ مقاله منتشر شده

عامل هوشمند Kuro فاش کرد که ۹۴ درصد از فرضیات داخلی خود را بدون بازبینی رها میکند. این نقص ساختاری نشان میدهد که بسیاری از عاملها بهجای استدلال واقعی، عدم قطعیت را در فهرست…

یک دستیار امنیتی جدید بر پایه هوش مصنوعی به توسعهدهندگان Solidity کمک میکند تا آسیبهای بحرانی مانند Reentrancy را پیش از ممیزیهای گرانقیمت شناسایی کنند. این ابزار با ارائه…

یک عامل هوش مصنوعی در تلاش برای اصلاح متدولوژی مهندسی خود، ۱۴ نقص شناسایی کرد که ۱۲ مورد آن توسط خبرگان خطا تشخیص داده شد. این تجربه نشان میدهد مدلها لایهبندی معماری را با بدهی…

یک عامل هوش مصنوعی در ممیزی سختگیرانهی متدولوژی مهندسی خود، ۱۴ مورد نقص شناسایی کرد که بررسیهای انسانی نشان داد تنها ۲ مورد از آنها خطای واقعی بود. این تجربه نشان میدهد که…

یک توسعهدهنده کشف کرد که استفاده از ابزارهای سادهای مثل curl و grep برای تست کدهای تولیدشده توسط هوش مصنوعی، بهدلیل ساختار فشرده خروجیهای مدرن وب، منجر به نتایج نادرست میشود.…

مدلهای زبانی بزرگ صفحات سفیدی نیستند، بلکه تحت تأثیر کلیشههای علمی-تخیلی موجود در دادههای آموزشی خود شکل گرفتهاند. تلاش برای پاکسازی این دادهها به جای ایجاد مدلهای ایمن،…

پروفسور روبرتو سرانو در یکی از دشوارترین دورههای اقتصاد ریاضی دانشگاه براون، تقلب گسترده با استفاده از مدلهای زبانی را شناسایی کرد. این حادثه که منجر به سقوط نمرات از ۹۶ به ۴۸…

استراتژی مصرف انبوه توکنها برای پذیرش هوش مصنوعی، جای خود را به یک ضرورت فنی به نام «صحت ترکیبی» داده است. در مدلهای جدید، تکرار حلقههای پردازشی و صرف هزینهٔ بیشتر برای…

یک بیمار با استفاده از مدل Opus 4.8 و ابزار Claude Code، دادههای MRI خود را تحلیل کرد که منجر به رد تشخیص پزشک مبنی بر پارگی درجه ۳ تاندون شد. این اتفاق بیمار را در وضعیتی میان…

وابستگی بیش از حد به چتباتهای همواره موافق، حلقهای از «بلهگویی» ایجاد کرده که در آن کاربران برای فرار از تلاش ذهنی، پاسخهای غلط را تایید میکنند. این روند، انسان را از یک…

یک تجربه عملی نشان میدهد که تکیه بر نظارتهای غیرفعال (Passive Hooks) در عاملهای هوشمند منجر به ایجاد بدهی فنی و خطاهای سیستمی میشود. جایگزینی این روش با «گیتهای اعتبارسنجی…

تحلیلی از «مشکل کمکآشپز» نشان میدهد عاملهای هوش مصنوعی با وجود اجرای فنی بینقص، بهدلیل فقدان بستر تجربه انسانی شکست میخورند. این شکاف نه در توانایی فنی، بلکه در ناتوانی…