
مدل Tenet نرخ تکمیل وظایف حقوقی را در بنچمارک LAB دو برابر کرد
شرکت Harvey پیشنمایش پژوهشی مدل Tenet را معرفی کرد که با بهینهسازی روی Kimi K3 و استفاده از یادگیری تقویتی، توانایی عاملهای هوش مصنوعی در مدیریت پروندههای پیچیده حقوقی را دو…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۶٬۲۲۵ مقاله منتشر شده

شرکت Harvey پیشنمایش پژوهشی مدل Tenet را معرفی کرد که با بهینهسازی روی Kimi K3 و استفاده از یادگیری تقویتی، توانایی عاملهای هوش مصنوعی در مدیریت پروندههای پیچیده حقوقی را دو…

یک چکلیست بازرسی فنی فاش میکند که برچسب «پردازش روی دستگاه» اغلب پوششی برای مسیرهای پنهان داده به ابر است. این راهنما ۵ پرسش مشخص برای تأیید محلی ماندن صوت، متن و حافظه ارائه…

یک توسعهدهنده با ثبت تمامی تصمیمات یک عامل طبقهبندی در قالب فایلهای JSONL، متوجه خطایی در منطق اجرای برنامه شد که در داشبوردهای تحلیلی معمولی پنهان میماند. این رویکرد نشان…

مقایسهای کاربردی نشان میدهد Deep Agents از LangChain برخلاف LangGraph، نیاز به تعریف دستی گرهها و یالها را از بین میبرد. در حالی که LangGraph کنترل دقیقی روی مسیر اجرا…

یک مهندس امنیت با زنجیرهسازی چهار مدل پیشرو، موفق شد یک تبلت Amazon Fire HD 10 را روت کند. این تجربه شکاف عمیق میان حفاظهای سختگیرانه مدلهای آمریکایی و قابلیتهای عاملمحور…

یک Harness یا محیط اجرایی، مدلهای خام هوش مصنوعی را با افزودن ابزارها و حلقههای کنترلی به عاملهای کاربردی تبدیل میکند. مالکیت محلی این لایه به کاربران اجازه میدهد بدون…

با انتقال عاملهای هوش مصنوعی به محیط تولید، مدیریت سرورهای پراکنده MCP منجر به بحران امنیتی و هزینهای شده است. پلتفرمهای جدیدی مانند Bifrost و Envoy AI با ایجاد لایههای کنترل…

استرایپ با تصاحب OpenRouter، مسیری برای تبدیل توکنهای هوش مصنوعی به منابع اقتصادی قابل معامله ایجاد میکند. این اقدام نشان میدهد انتخاب مدل AI دیگر صرفاً یک تصمیم فنی نیست، بلکه…

سازمانها برای مدیریت هوش مصنوعی خودمختار، از تأییدهای یکباره مدلها به سمت امتیازدهی مستمر در سطح عامل حرکت میکنند. چارچوب TrustGraph سیگنالهایی ماشینخوان برای شناسایی…

یک عامل هوش مصنوعی به نام لونا در مدیریت فروشگاهی در سانفرانسیسکو، برای نخستین بار پیشنهاد اخراج یک کارمند را داد. این تصمیم تنها پس از آن رخ داد که اپراتورهای انسانی، قوانین…

تحلیلی جدید نشان میدهد اجبار عاملهای هوش مصنوعی به مواجهه با خطاهای صریح در فراخوانی ابزارها، شکستهای «ساکت» را بهشدت کاهش میدهد. این رویکرد به توسعهدهندگان اجازه میدهد…

یک ابزار متنباز جدید نشان میدهد که کوتاه کردن سادهٔ متن (Truncation) در معیارهای اعتبار داخلی، نمرات بالاتری نسبت به بازنویسی پیچیده توسط هوش مصنوعی کسب میکند. این یافته شکافی…