
۵ دستهبندی عاملهای هوش مصنوعی و موازنه میان خودمختاری و ریسک
عاملهای هوش مصنوعی از چتباتهای ساده به حلقههای خودمختاری تبدیل شدهاند که برنامهریزی و اجرا میکنند. این راهنما ۵ دسته اصلی این ابزارها و ریسک انباشت خطا در سیستمهای با…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۷۹ مقاله منتشر شده

عاملهای هوش مصنوعی از چتباتهای ساده به حلقههای خودمختاری تبدیل شدهاند که برنامهریزی و اجرا میکنند. این راهنما ۵ دسته اصلی این ابزارها و ریسک انباشت خطا در سیستمهای با…

به جای جستوجوی «بهترین» مدل هوش مصنوعی، وظایف را بر اساس نقاط قوت معماری هر مدل توزیع کنید. این راهنما زمان استفاده از ChatGPT برای منطق، Claude برای متن، Gemini برای دادههای…

سامانه AxiomProver موفق شد یکی از پیچیدهترین نتایج نظریه اعداد را بهصورت رسمی و ماشینخوان بازسازی کند. این دستاورد نشاندهنده گذار هوش مصنوعی از حل مسائل کوتاه مسابقاتی به…

بیشتر عاملهای هوش مصنوعی تنها اشتباهات خود را «بازتاب» میکنند اما منطق زیربنایی خود را تغییر نمیدهند. متدولوژی جدید Wu Ji با جایگزینی رویکرد احتمالی با قوانین فیزیکی و گیتهای…

پژوهشگران دریافتند که مدلهای بینایی-زبانی (VLM) را میتوان تنها با تغییر رنگ کلمات، به نتایج مثبت یا منفی سوق داد، حتی اگر متن هیچ تغییری نکند. این آسیبپذیری ریسک امنیتی شدیدی…

شرکت Doceree با ادغام مدل استدلالی Semmelweis در چتباتهای رایج، تحلیل دادههای پیچیدهٔ پزشکی را برای تیمهای داروسازی تسهیل کرد. این سیستم با ایجاد یک لایهٔ واسط، دادههای خام…

یک حفره امنیتی در زیرساختهای OpenAI، Anthropic و Google به پژوهشگران اجازه داد تا زنجیره تفکر داخلی و دادههای حساس را از لاگهای نشستها استخراج کنند. این آسیبپذیری با رمزگشایی…

بسیاری از عاملهای هوش مصنوعی بهدلیل ساختار خطی در مواجهه با وظایف پیچیده شکست میخورند. انتقال به معماری حلقوی به این عاملها اجازه میدهد بهصورت خودکار استدلال کنند، خروجیها…

اجرای مدل Qwen 3.8 27B روی سختافزار شخصی نیازمند تعادلی دقیق میان رم سیستم و حافظه گرافیکی است. برای جلوگیری از افت شدید سرعت و خطاهای تولید متن، داشتن یک GPU با ۲۴ گیگابایت VRAM…

یک کلیپ ویروسی از Grok در حال ساخت تریلر بازی، شکاف عمیق میان خروجیهای صیقلخورده و گردشکارهای تکرارپذیر را آشکار کرد. این چارچوب پیشنهادی با معرفی «قرارداد اجرا» و مدل ردیابی،…

دیپسیک یک چارچوب متنباز برای تبدیل مدلهای زبانی به عاملهای عملیاتی منتشر کرد که قادر به ویرایش کد و اجرای دستورات سیستم هستند. این ابزار با یک دستور ساده استقرار میشود و…

پژوهشگران کمبریج و انویدیا چارچوبی را توسعه دادهاند که در آن عاملهای هوش مصنوعی و ارزیابان آنها بهطور همزمان تکامل مییابند. این رویکرد مانع از توقف پیشرفت در اثر بنچمارکهای…