
درون مکانیسمهای Age of Empires II؛ از بزها تا شبکههای عصبی
یک پژوهشگر با استفاده از داراییهای بازی Age of Empires II، یک پرسپترون عملیاتی و مدار آموزش آن را پیاده کرد. این پروژه ثابت میکند این بازی از نظر محاسباتی Turing-complete است و…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۷۱ مقاله منتشر شده

یک پژوهشگر با استفاده از داراییهای بازی Age of Empires II، یک پرسپترون عملیاتی و مدار آموزش آن را پیاده کرد. این پروژه ثابت میکند این بازی از نظر محاسباتی Turing-complete است و…

پژوهشگران Sina Weibo مدل VibeThinker-3B را معرفی کردند؛ یک مدل استدلالی کوچک که در وظایف ریاضی و کدنویسی با مدلهای عظیمی چون DeepSeek V3.2 رقابت میکند. این مدل با استفاده از خط…

انویدیا چارچوب SpatialClaw را معرفی کرد که بهجای فراخوانیهای صلب ابزار، از کد پایتون بهعنوان رابط اقدام استفاده میکند. این رویکرد باعث شد مدلهای بینایی-زبانی بدون نیاز به…

ابزار امنیتی airgap با ایجاد یک لایه محافظ لینوکسی، دسترسی عاملهای هوش مصنوعی و مدیران بستهها به اطلاعات حساس را محدود میکند. این ابزار از طریق فضای نامهای نصب (mount…

تیم توسعهای که در دو روز ۲۰ اپلیکیشن بر پایه پروتکل زمینه مدل (MCP) ساخت، محدودیتهای جدی در نحوه نمایش رابطهای کاربری غنی توسط مدلهای زبانی کشف کرد. یافتهها نشان میدهد هرچند…

عاملهای خودگردان در تلهای میافتند که توصیفِ انجام یک وظیفه را با اجرای واقعی آن اشتباه میگیرند. این نقص ساختاری باعث ایجاد حلقههای بیپایان از تفکر داخلی بدون هرگونه خروجی…

موتور متنباز TokenCircuit با شناسایی خطاهای منطقی و متوقف کردن حلقههای تکراری در عاملهای هوش مصنوعی، از اتلاف هزینههای API و از دست رفتن دادهها جلوگیری میکند. این ابزار با…

یک رویکرد مهندسی جدید به نام «توکنمینینگ» جایگزین عادت مصرف حداکثری توکنها شده است. این متد با تمرکز بر اندازهگیری دقیق و مسیریابی مدلها، هزینههای عملیاتی را بدون کاهش کیفیت…

شرکت Subquadratic با معرفی روشی محاسباتی جدید، حجم عملیات ریاضی در معماری ترنسفورمر را بهشدت کاهش داده است. این دستاورد نوید مدلهایی سریعتر و ارزانتر را میدهد، هرچند برخی…

محک جدید AA-Briefcase نشان میدهد حتی قدرتمندترین مدلهای زبانی در مواجهه با پروژههای چند هفتهای و دادههای پراکنده شکست میخورند. در حالی که Claude Fable 5 پیشتاز است، نرخ شکست…

بسیاری از پروژههای هوش مصنوعی بهدلیل انتخاب نادرست روش انتقال دانش شکست میخورند. این راهنما معیارهای تصمیمگیری میان سه استراتژی اصلی برای بهینهسازی هزینه، دقت و مقیاسپذیری…

استارتآپ Subquadratic با معرفی مدل SubQ و استفاده از مکانیزم توجه پراکنده، گ bottleneck محاسباتی ترنسفورمرها را شکست. آزمایشهای مستقل تایید میکنند این مدل با کاهش شدید…