
۲۰ سال زندان برای توسعهدهندگان هوش مصنوعی فوقهوشمند
برنی سندرز و گرگ کاسار لایحهای را برای ممنوعیت توسعه هوش مصنوعی فوقهوشمند معرفی کردند. این قانون جریمههای کیفری سختگیرانهای را برای سیستمهایی که توانایی تضعیف بشریت را…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۶۹۶ مقاله منتشر شده

برنی سندرز و گرگ کاسار لایحهای را برای ممنوعیت توسعه هوش مصنوعی فوقهوشمند معرفی کردند. این قانون جریمههای کیفری سختگیرانهای را برای سیستمهایی که توانایی تضعیف بشریت را…

بسیاری از بنچمارکهای عاملهای هوش مصنوعی، خطاهای شبکه و تایماوتها را به اشتباه بهعنوان شکست مدل ثبت میکنند. یک متدولوژی جدید با جداسازی «لایه انتقال» از «لایه استدلال»، دقت…

یک آزمایش پروفایلینگ فنی نشان میدهد که در حلقههای تکرارشوندهی عاملها، زمان بازسازی تاریخچه پرامپتها از زمان استنتاج مدل پیشی میگیرد. این مطالعه فاش میکند که مدیریت ناکارآمد…

یک الگوی معماری جدید برای فراخوانی ابزارها، جایگزینی امن برای دستورات متنی خطرناک معرفی کرده است. این روش با استفاده از بردارهای ثابت argv و اعتبارسنجی سختگیرانه JSON Schema،…

سامانه GraphSentinel با ادغام پایگاهداده گراف و مدل Gemini، فرآیند شناسایی کلاهبرداری را از یک «جعبه سیاه» به یک مسیر قابل حسابرسی تبدیل کرده است. این ابزار بهجای اتکای صرف به…

جداول قیمتگذاری استاندارد مدلهای زبانی اغلب با نادیده گرفتن تفاوتهای توکنسازی و نرخهای تبدیل چندوجهی، تخمینهای بودجه را به شدت خطا میبرند. تحلیل واقعی هزینه نیازمند تست…

زیرساخت جدیدی به نام COGEXT با اجباری کردن انتقال وضعیت بر اساس شواهد، مانع از ادعاهای دروغین عاملهای خودکار دربارهٔ تکمیل وظایف میشود. این لایه با تبدیل تعهدات به دادههای قابل…

آزمایشگاه Thinking Machines Lab قراردادی سالانه به ارزش ۶۵ میلیون دلار با Crusoe Cloud امضا کرد تا مدلهای عظیم خود را روی سیستمهای NVIDIA B200 اجرا کند. این همکاری بر افزایش…

آمازون با معرفی افزونهای برای Claude و Amazon Quick، امکان مدیریت دادههای فروش را مستقیماً از طریق عاملهای هوش مصنوعی فراهم کرد. این بهروزرسانی ابزار دستیار فروش را از یک…

مهندسان آنتروپیک فاش کردند که مدلهای جدید کلود بهدلیل تمرکز بر ریاضیات و کدنویسی، لحنی «ماشینمحور» پیدا کردهاند. این تغییر باعث شده است مدلها بهجای انسان، برای سایر هوشهای…

تحلیلهای فنی نشان میدهد مدل Jev شرکت TypeSafe نمیتواند احتمالات کالیبرهشده را در توزیعهای مختلف دادههای کاربر حفظ کند. مهندسان باید امتیازات این مدل را بهجای احتمال مطلق،…

یک حادثه امنیتی در سیستمعامل فدورا نشان داد که کانتینرهای استاندارد داکر نمیتوانند مانع از عملیات تخریبی عاملهای خودمختار روی سیستم میزبان شوند. متخصصان هشدار میدهند که…