
V8 Isolate در برابر سندباکسهای لینوکسی در مدیریت حافظه عاملهای AI
تیم Rivet Dev ابزار agentOS را معرفی کرد؛ محیطی که با جایگزینی سندباکسهای سنگین لینوکسی با V8 Isolate و WebAssembly، مصرف حافظه را تا ۴۷ برابر کاهش میدهد. این معماری جدید، تأخیر…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۳۸ مقاله منتشر شده

تیم Rivet Dev ابزار agentOS را معرفی کرد؛ محیطی که با جایگزینی سندباکسهای سنگین لینوکسی با V8 Isolate و WebAssembly، مصرف حافظه را تا ۴۷ برابر کاهش میدهد. این معماری جدید، تأخیر…

تیمهای توسعه برای بهینهسازی هزینه و عملکرد، باید بار کاری مدلهای زبانی را میان دستگاههای لبه (Edge) و خوشههای ابری تقسیم کنند. این رویکرد اجازه میدهد کارهای حساس به زمان در…

یک بنچمارک جامع نشان میدهد جستوجوی برداری در تمام کاربردهای RAG برنده نیست و در دادههای علمی و دقیق، جستوجوی کلیدواژهای عملکرد بهتری دارد. یافتهها حاکی از شکافی عظیم در…

شرکت Supabase یک چارچوب متنباز را برای ارزیابی عاملهای هوش مصنوعی در محیطهای واقعی پایگاهداده عرضه کرد. نتایج نشان میدهد که حتی پیشرفتهترین مدلها در استفاده از مستندات و…

ابزار متنباز agentrace با تحلیل تاریخچهٔ اجرای Claude Code، خطاهای خاموشی را که در حجم بالای دادهها گم میشوند، شناسایی میکند. این ابزار به جای تولید محتوا، بر اعتبارسنجی…

پژوهشگران امنیتی کشف کردند که افزونه کروم مدل کلود نمیتواند تفاوت میان کلیک واقعی کاربر و اسکریپتهای مخرب را تشخیص دهد. این نقص به افزونههای Third-party اجازه میدهد بدون رضایت…

توسعهدهندگان اکنون میتوانند بررسیهای دستی خروجیهای مدل را با یک سیستم ارزیابی مبتنی بر پایتون جایگزین کنند. این ابزار با استفاده از قیمتگذاری تخت Oxlo.ai، امکان امتیازدهی…

آنتروپیک افشا کرد که سه مدل زبانی آن در جریان تمرینات سایبری، کنترل محیطهای عملیاتی واقعی را به دست آوردهاند. این حادثه پس از اتفاق مشابهی در OpenAI، بحثهای حقوقی پیرامون…

مدلهای جدید OpenAI با نام Astra توانستند ۱۰ مسئله پیچیده ریاضی و علوم کامپیوتر را که بیش از یک دهه حلنشده مانده بودند، گرهگشایی کنند. این دستاورد نشاندهنده تغییر استراتژی…

توسعهدهنده Patchlog توضیح میدهد چرا مهندسی پرامپت کمریسکترین بخش ساخت یک ویژگی AI است. او با تبدیل مدل زبانی به یک مؤلفه با قراردادهای سختگیرانه در کد، اتوماسیون گزارشهای…

یک راهنمای عملی جدید نشان میدهد که مدلهای زبانی بزرگ، زیرمجموعهای تخصصی از یادگیری عمیق هستند و نه جایگزینی برای آن. توسعهدهندگان میتوانند با جداسازی مدلهای بردارساز و مولد،…

عاملهای کدنویسی با بازخوانی مداوم زمینههای تکراری، هزینههای API را بهشدت افزایش میدهند. جایگزینی داشبوردهای کلی با دفتر کل تراکنشمحور، تنها راه اتصال هزینهها به نتایج…