
درون معماری Zero-Idle-RAM برای بهینهسازی اجرای مدلهای زبانی بزرگ
شرکت ShadowSocial با طراحی یک لایه ارکستراسیون سفارشی، توانست مدلهای Qwen-Max و Wan 2.1 را بدون پرداخت هزینه برای حافظه غیرفعال اجرا کند. این متد با ترکیب گرمسازی پیشبینانه و…
موضوع
۴٬۴۱۷ مقاله منتشر شده

شرکت ShadowSocial با طراحی یک لایه ارکستراسیون سفارشی، توانست مدلهای Qwen-Max و Wan 2.1 را بدون پرداخت هزینه برای حافظه غیرفعال اجرا کند. این متد با ترکیب گرمسازی پیشبینانه و…

مایکروسافت یک عامل متنباز برای تولید تستهای واحد معرفی کرد که با تحلیل جامع مخزن کد، عملکرد GitHub Copilot را به شکل چشمگیری بهبود میبخشد. این ابزار بهویژه در مواجهه با…

گوگل با معرفی حالت Build و Canvas در AI Studio، امکان تبدیل پرامپت به اپلیکیشن را فراهم کرده است، اما استقرار واقعی این ابزارها هنوز نیازمند کدنویسی دستی است. در حالی که ابزارهای…

ابزار متنباز claude-hookscanner با استفاده از امضاهای HMAC، کدهای مخرب تزریقشده در محیطهای کاری را از هوکهای تأییدشده کاربر تشخیص میدهد. این ابزار حفرهای بحرانی را میبندد…

عاملهای کدنویس هوش مصنوعی سرعت توسعه را بالا بردهاند، اما نادیده گرفتن مرزبندیهای معماری باعث ایجاد سیستمهای غیرقابل نگهداری میشود. چارچوب جدید «قراردادهای معماری» با تعریف…

یک مهندس نرمافزار ابزاری به نام StagingBrief ساخته است که تاریخچه پیچیده کامیتهای GitLab را به اعلانهای ساده در Slack تبدیل میکند. این بات با استفاده از مدلهای زبانی، شکاف…

یک چارچوب ارزیابی جدید با استفاده از ASan و UBSan ثابت کرد که اصلاحات کد C++ توسط هوش مصنوعی اغلب در ظاهر درست اما در زمان اجرا شکست میخورند. این سیستم سیگنالهای باینری پاس/فیل…

کتابخانه vLLM با جایگزینی مدیریت حافظه سنتی با سیستمی شبیه به حافظه مجازی سیستمعامل، اتلاف حافظه در KV Cache را حذف کرده است. این رویکرد اجازه میدهد در محیطهای عملیاتی، تعداد…

یک الگوی معماری جدید با جداسازی «قصد» مدل از «اختیار» اجرا، از ترکیب تصادفی مجوزهای بیخطر برای انجام اقدامات مخرب جلوگیری میکند. در این روش، امنیت به جای تکیه بر پرامپتهای…

یک توسعهدهنده با استفاده از یک مدل زبانی کوچک و کوانتیده بهعنوان «دیسپچر»، توانست از طریق گوشی موبایل و دیسکورد، عاملهای کدنویسی قدرتمند را مدیریت کرده و تغییرات پیچیده…

یک خط لوله (Pipeline) خودکار جدید با استفاده از یک «گیت بازبینی» مبتنی بر شل-اسکریپت، وصلههای تولیدشده توسط هوش مصنوعی را پیش از بررسی انسانی ممیزی میکند. این روش با ایزولهسازی…

یک متد جدید ممیزی با استفاده از فایلهای «تله» و ثبت وضعیت دایرکتوریها، خروج بیصدای عاملهای هوش مصنوعی از فضای کاری تعیینشده را ردیابی میکند. این رویکرد بهجای اعتماد…