
Anthropic در برابر OpenAI؛ رقابت بر سر تصاحب زمان اجرای مهارتها
رقابت برای ساخت «هوشمندترین» مدل به بنبست رسیده و میدان نبرد به زیرساختهای پلتفرم منتقل شده است. اکنون هدف هر دو غول AI، تصاحب «زمان اجرای مهارتها» (Skill Runtime) برای تبدیل…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۶٬۲۴۶ مقاله منتشر شده

رقابت برای ساخت «هوشمندترین» مدل به بنبست رسیده و میدان نبرد به زیرساختهای پلتفرم منتقل شده است. اکنون هدف هر دو غول AI، تصاحب «زمان اجرای مهارتها» (Skill Runtime) برای تبدیل…

یک راهنمای پیادهسازی جدید نشان میدهد چگونه میتوان با اتصال Wispr Flow به سرورهای MCP، فراتر از تبدیل ساده صوت به متن رفت. این سامانه جملات گفتاری را به وظایفی قابل اجرا برای…

بهروزرسانی جدید Microsoft Agent Framework امکان انتقال سریع عاملهای محلی به ابر را برای توسعهدهندگان .NET فراهم کرد. این تغییر نیاز به پیکربندیهای پیچیده Docker و مسیریابی API…

کاهش ریسک در استقرار هوش مصنوعی از طریق تمرکز بر گردشکارهای تکرارپذیر داخلی بهجای ابزارهای مشتریمحور. کلید موفقیت در این مسیر، ترکیب مدلهای زبانی با منطق سخت کسبوکار و نظارت…

شرکت Omnifys برای مقابله با خطاهای رایج در اتصال APIها، از عاملهای خودمختار استفاده میکند که میتوانند تغییرات ناگهانی در ساختار دادهها را تحلیل کرده و برطرف کنند. این رویکرد…

یک عامل هوش مصنوعی جدید برای مدیریت حوادث، بهجای اجرای سریع اصلاحات، بر تشخیص دقیق و خویشتنداری متمرکز شده است. این سیستم با استفاده از یک «نردبان خودمختاری»، ریسک اقدامات…

یک الگوی معماری جدید برای عاملهای تحلیل هزینه AWS، هشدارهای مبهم بودجه را به توضیحات مستند تبدیل میکند. این سیستم با ترکیب دادههای هزینه و رویدادهای زیرساختی، کاربر و اقدام…

یک پژوهشگر امنیتی دریافت که بسیاری از سامانههای تست عاملهای هوش مصنوعی، در صورت عدم دسترسی به هدف، بهاشتباه وضعیت «پاس» را گزارش میکنند. استفاده از سه «نگهبان تشخیصی» میتواند…

پروژه متنباز the-finn روترهای OpenWrt را به عاملهای خودمختاری تبدیل میکند که ناهنجاریهای شبکه را رصد میکنند. برخلاف دستیارهای مودب، این سیستم یک ناظر «بدقلق» است که ترافیک…

شرکت Z.ai وزنهای مدل GLM-5.3 را منتشر کرد که با حجم ۷۵۶ گیگابایت، بهطور تخصصی برای مهندسی نرمافزار و شکار آسیبپذیریها طراحی شده است. برخلاف مدلهای پیشین، پیشرفت این نسخه نه…

آنتروپیک بازار رسمی افزونههای Claude Code را برای استانداردسازی گردشکارهای توسعه معرفی کرد. اکنون برنامهنویسان باید بین رویکرد خودکار Superpowers و سیستم دستور-محور DevFlux…

چارچوب ارزیابی FINAL-Bench نشان میدهد مدلهای زبانی بزرگ اغلب در شناسایی و اصلاح خطاهای استدلالی خود ناتواناند و حتی پاسخهای درست را به غلط تبدیل میکنند. این «تنگنای…