سقف ۱۵۰۰ دلاری اوبر برای هزینه ماهانه ابزارهای کدنویسی هوش مصنوعی
شرکت اوبر پس از آنکه بودجه سالانه خود را تنها در چهار ماه سوزاند، سقف هزینه ماهانه برای ابزارهای کدنویسی AI را تعیین کرد. این تصمیم نشاندهنده چرخش این شرکت از پذیرش تهاجمی فناوری…
موضوع
Autonomous agents, tool use, planning, multi-step workflows
۵٬۹۱۷ مقاله منتشر شده
شرکت اوبر پس از آنکه بودجه سالانه خود را تنها در چهار ماه سوزاند، سقف هزینه ماهانه برای ابزارهای کدنویسی AI را تعیین کرد. این تصمیم نشاندهنده چرخش این شرکت از پذیرش تهاجمی فناوری…
انویدیا در نسخهی JetPack 7.2 قابلیتهای خودکارسازی استقرار را معرفی کرد تا فاصله بین نمونههای آزمایشگاهی و تولید صنعتی رباتها کاهش یابد. این بهروزرسانی همچنین با معرفی Super…
پشتهی نرمافزاری NemoClaw از شرکت NVIDIA به عاملهای هوش مصنوعی اجازه میدهد مهارتهای جدید را مستقیماً از گفتگو با کاربر بیاموزند و آنها را ذخیره کنند. این سیستم با استفاده از…
انویدیا و مایکروسافت با معرفی کانتینرهای امنیتی و بهینهسازیهای سختافزاری، اجرای سریع عاملهای هوش مصنوعی روی ویندوز را ممکن کردند. این بهروزرسانی سرعت استنتاج را تا ۲.۶ برابر…
مدل M3 از شرکت MiniMax، نخستین مدل بازمتنی است که حافظه یک میلیون توکنی را با قابلیتهای چندوجهی ترکیب میکند. این مدل در بنچمارکهای کدنویسی و جستجوی وب، رقبای قدرتمندی چون…
ریچارد ساتون، برنده جایزه تورینگ، معتقد است مدلهای زبانی فعلی به دلیل نبود «حلقه ارزیابی» قادر به اکتشاف علمی نیستند. این مدلها در تقلید عالیاند، اما برای کشف حقیقت به سیستمی…
اوپنایآی با ادغام لیستهای شغلی زنده و ویرایشگر رزومه، ChatGPT را به یک پلتفرم جامع برای مدیریت مسیر شغلی تبدیل کرد. این بهروزرسانی، ابزاری که پیشتر فقط برای پیشنویس متن بود…
هکرهای حرفهای با سوءاستفاده از یک نقص امنیتی در چتبات پشتیبانی متا، حسابهای سطح بالای اینستاگرام از جمله صفحه کاخ سفید اوباما را سرقت کردند. این حمله با دور زدن احراز هویت دو…
OpenAI در حال تبدیل Codex از یک ابزار تخصصی کدنویسی به اپلیکیشن بهرهوری برای متخصصان کسبوکار است. جذب کاربران غیربرنامهنویس با سرعتی سه برابر بیشتر از توسعهدهندگان، مسیر این…
لنگچین ابزار RubricMiddleware را معرفی کرد تا عاملهای هوش مصنوعی بتوانند خروجیهای خود را بر اساس معیارهای مشخص اصلاح کنند. در این سیستم، یک عامل ارزیاب با استفاده از ابزارهای…
شرکتهای LangChain و Harvey چارچوبی برای کاهش هزینهی تأیید صحت عملکرد عاملهای حقوقی پیچیده معرفی کردهاند. یافتههای آنها نشان میدهد مدل DeepSeek-V4-Flash میتواند با هزینهای…
مدلهای پیشرو همچنان در رفع نیمی از آسیبپذیریهای امنیتی واقعی ناتواناند. بنچمارک CVE-Bench نشان میدهد که «استدلال امنیتی» در این مدلها بیشتر شبیه به تطبیق الگو است تا تحلیل…