
بهینهسازی مبتنی بر هوش مصنوعی تخلخل چاپ فلزی را ۳۰٪ کاهش داد
یک روال بهینهسازی جدید با استفاده از هوش مصنوعی، نقصهای تخلخل در تولید افزایشی فلزات را ۳۰٪ کاهش داده است. این سیستم کالیبراسیون دستی را با عملیاتی تککلیکی بر اساس دادههای…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۵ مقاله منتشر شده

یک روال بهینهسازی جدید با استفاده از هوش مصنوعی، نقصهای تخلخل در تولید افزایشی فلزات را ۳۰٪ کاهش داده است. این سیستم کالیبراسیون دستی را با عملیاتی تککلیکی بر اساس دادههای…

یک گردشکار جدید با ترکیب GitHub Copilot CLI و سرور MCP ابزار AgentInspect، عیبیابی عاملهای هوش مصنوعی را از بررسی لاگهای متنی به تحلیل ردپاهای ساختاریافته تغییر میدهد. این…

یک استراتژی جدید با ترکیب vLLM و کوانتش INT8، هزینه اجرای Grok-2 را به ۰.۰۰۶۷ دلار بهازای هر میلیون توکن رسانده است. این معماری، مدلهای استدلالی پیشرفته را بهشدت ارزانتر از…

افزایش توان استدلالی عاملهای هوش مصنوعی بدون ایجاد کنترلهای خارجی، سیستمی شبیه به «موتور قدرتمند بدون ترمز» میسازد. ایمنی واقعی نیازمند مرزهای معماری مانند گیتهای تأیید و…

سیستمهای تولید بازیابیافزا (RAG) زمانی شکست میخورند که مدلهای زبانی دادههای نامرتبط دریافت کنند. برای رسیدن به دقت سطح تولید، ترکیب جستوجوی معنایی و کلیدواژهای در کنار…

افزایش پنجرهٔ زمینه به میلیونها توکن، مشکل بازیابی اطلاعات و وضعیت بلندمدت را حل نمیکند. پژوهشها نشان میدهند مدلها همچنان دچار سوگیری «گمشدن در میانه» و هزینههای عملیاتی…

سازمانها برای فرار از سیاستهای محدودکننده داده و رابطهای بسته، به سمت زیرساختهای ماژولار و متنباز حرکت میکنند. جداسازی لایههای مدل، استنتاج و داده، جابهجایی بین محیطهای…

یک پژوهشگر امنیتی ثابت کرد که جایگزینی پرامپتهای کلی با «قراردادهای سختگیرانه»، توهمات هوش مصنوعی را حذف و منجر به شناسایی ۴ آسیبپذیری واقعی در مخازن متنباز میشود. این متد با…

آنتروپیک با معرفی نسخههای Fable 5.1 و Mythos 5.1، هزینههای گردشکارهای عاملمحور را بهشدت کاهش داد. این بهروزرسانی بر بهبود استدلال علمی و بهینهسازی قیمتگذاری دادههای…

اجرای مدل Whisper مستقیماً در مرورگر، مرزهای حریم خصوصی را با نگه داشتن دادههای صوتی در دستگاه کاربر جابهجا میکند. این معماری برای جلوگیری از هنگ کردن رابط کاربری، بر…

یک تحلیل فارنزیک نشان میدهد تقریباً تمام فایلهای آزمون در بنچمارک SWE-bench پیش از اعمال اصلاحات، بهصورت عمومی در گیتهاب در دسترس بودهاند. این یعنی مدلهای پیشرو احتمالاً…

تحلیل جدید هزینه کل مالکیت نشان میدهد که جایگزینی APIها با زیرساخت شخصی برای حجمهای بالا، حدود یک سال زمان میبرد تا هزینه سرمایهگذاری اولیه را جبران کند. این سودآوری به شدت به…