
کدهای گمشدهٔ ELIZA؛ ریشههای روانشناختی توهمات در هوش مصنوعی مدرن
بازکشف کدهای منبع برنامهٔ ELIZA از دههٔ ۶۰ میلادی نشان میدهد که مدلهای زبانی بزرگ امروز همچنان بر پایهٔ همان ترفند روانشناختی پیشین عمل میکنند. «اثر الیزا» توضیح میدهد چرا…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۰ مقاله منتشر شده

بازکشف کدهای منبع برنامهٔ ELIZA از دههٔ ۶۰ میلادی نشان میدهد که مدلهای زبانی بزرگ امروز همچنان بر پایهٔ همان ترفند روانشناختی پیشین عمل میکنند. «اثر الیزا» توضیح میدهد چرا…

شرکت Mistral AI مدل Robostral Navigate را معرفی کرد؛ یک مدل ۸ میلیارد پارامتری که رباتها را قادر میسازد تنها با یک دوربین معمولی و بدون نیاز به حسگرهای گرانقیمت، در محیطهای…

Blume یک چارچوب متنباز جدید است که پوشههای Markdown را بدون نیاز به تنظیمات پیچیده به سایتهای مستندات حرفهای تبدیل میکند. این ابزار با پشتیبانی بومی از پروتکل MCP و تولید…

یک الگوی معماری جدید، تأییدیه های ایمیلی انسان را بهجای اعلان ساده، به عنوان نقاط بازرسی سیستمی تعریف میکند. این روش با استفاده از شناسههای منحصربهفرد برای هر اجرا، از خطاهای…

یک چارچوب اندازهگیری جدید ادعا میکند ادعاهای مبهم دربارهٔ «صرفهجویی در باتری» در هوش مصنوعی گمراهکننده است. توسعهدهندگان اکنون میتوانند با ردیابی چهار بودجهٔ مجزا (تأخیر،…

پروژه MonkeyCode با معرفی قالب ساختاریافته JSON برای گزارش باگها، ابهام در توصیفات متنی را حذف کرد. این روش به عاملهای کدنویسی اجازه میدهد خطاها را بدون حدسزدن درباره محیط یا…

یک چارچوب جدید برای اندازهگیری میزان شواهد مستند در پروژهها معرفی شده تا عاملهای AI بتوانند بدون دخالت انسانی و با اطمینان عمل کنند. این متد تمرکز را از تولید متن ساده به حفظ…

اوپنایآی با معرفی خانواده مدلهای GPT-5.6، قابلیت فراخوانی برنامهریزیشده ابزارها را از طریق سندباکس V8 بهینه کرد. این بهروزرسانی هزینه و تأخیر در گردشکارهای پیچیده MCP را…

یک پیشنهاد فنی جدید برای ثبت وقایع عاملهای هوش مصنوعی، توصیه میکند به جای ثبت صرفِ مسیر طیشده، دلایل رد گزینههای جایگزین نیز ذخیره شوند. این رویکرد اجازه میدهد انسانها مرز…

شرکت MonkeyCode راهکاری برای جلوگیری از تداخل درخواستهای همزمان هنگام تغییر مدل AI معرفی کرد. این پروتکل تضمین میکند که تنها آخرین تصمیم کاربر اعمال شود و تأخیرهای شبکه باعث…

تاد لینرتز، متخصص حاکمیت AI، هشدار میدهد که قابلیتهای «حل مشکل» (Solve) در ابزارهای کدنویسی، با ترکیب شناسایی خطا و رفع آن در یک مرحله، شکاف امنیتی خطرناکی ایجاد میکنند. او…

آنتروپیک مدل Claude Sonnet 5 را با تمرکز بر پایداری در چرخههای طولانی عاملمحور عرضه کرد. این مدل شکاف عملکردی با Opus 4.8 در کدنویسی را میبندد و قیمتهای introductory بسیار…