پرش به محتوای اصلی

موضوع

بازتولیدپذیری هوش مصنوعی

گزارش‌ها و تحلیل‌های مربوط به توانایی تکرار و تأیید نتایج پژوهش‌های هوش مصنوعی

۲۳۴ مقاله منتشر شده

نامه‌ای به منِ شنبه: زمان را قبل از اجرای ریموتی متوقف کن
آموزش کاربردی

چطور مانع از حذف محدودیت‌های زمانی توسط عامل‌های هوش مصنوعی شویم؟

یک گردش‌کار جدید با اجبار به استفاده از تست‌های زمان‌منجمد و کاست‌های شبکه، از ایجاد باگ‌های ناپایدار توسط هوش مصنوعی جلوگیری می‌کند. این روش مانع از آن می‌شود که مدل‌ها برای سبز…

۷ دقیقه خواندن۱
شبکه TauGrid مایکروسافت: پلتفرم متن‌باز مدیریت بارهای کاری GPU در Kubernetes
آموزش کاربردی

مایکروسافت با متن‌باز کردن TauGrid پیچیدگی‌های مدیریت GPU در کوبرنتیز را حذف کرد

مایکروسافت ابزار TauGrid را تحت لایسنس MIT منتشر کرد تا مدیریت صف‌بندی و نظارت بر GPUها را در محیط کوبرنتیز یکپارچه کند. این پشتهٔ نرم‌افزاری نیاز تیم‌های پلتفرم به ترکیب دستی…

۴ دقیقه خواندن۳
ارزیابی اعتبارسنجی متقابل: روشی برای سنجش قابل‌اعتماد عملکرد مدل‌های یادگیری ماشین با تقسیم داده‌ها به زیرمجموعه‌های آموزشی و
آموزش کاربردی

اعتبارسنجی متقابل؛ سدی در برابر توهمِ دقت در مدل‌های هوش مصنوعی

اعتبارسنجی متقابل با چرخش داده‌های آزمون، تخمین دقیقی از عملکرد واقعی مدل ارائه می‌دهد. این روش از خطای رایجِ بیش‌برآوردی صحت مدل که ناشی از تفکیک‌های ناپایدار داده است، جلوگیری…

۱۱ دقیقه خواندن
نوار مکالمات مدل: یک کاست آخر هفته برای پروژه‌های جانبی عامل هوشمند
آموزش کاربردی

الگوی Cassette نشت‌های مهندسی را در دموهای عامل‌های هوش مصنوعی می‌بندد

یک الگوی سبک پایتونی به نام Cassette با ضبط و بازپخش پاسخ‌های مدل، پایداری دموهای هوش مصنوعی را تضمین می‌کند. این روش با حذف وابستگی به APIهای زنده، ریسک تأخیر و خطاهای سهمیه را…

۸ دقیقه خواندن
من به هوش مصنوعی اجازه دادم یک مقاله فنی بدون هیچ ویرایش انسانی بنویسد، سپس آن را از فرآیند تأیید معمولی‌ام عبور دادم.
زندگی با AI

آزمون نویسندگی فنی: شناسایی ۱۱ خطای پنهان توسط بازبینی انسانی

آزمایشی در زمینه نویسندگی فنی با هوش مصنوعی نشان داد که مدل‌ها در پر کردن شکاف بین داده‌های موجود و واقعیت شکست می‌خورند. یک مرحله بازبینی انسانی توانست ۱۱ خطایی را شناسایی کند که…

۸ دقیقه خواندن
چارچوب Paper2Agent برای تبدیل مقالات پژوهشی به عامل‌های هوش مصنوعی

«بازتولید نتایج پژوهشی»؛ قابلیت جدید عامل‌های هوشمند در سیستم Paper2Agent

پژوهشگران استنفورد سیستمی را توسعه داده‌اند که مقالات علمی و کدهای آن‌ها را به سرورهای MCP تبدیل می‌کند. این فناوری به عامل‌های هوش مصنوعی اجازه می‌دهد نتایج پژوهشی را بازتولید…

۵ دقیقه خواندن
مدل ۷ میلیارد پارامتری ZGCM-1 که با یادگیری خودی از مدل‌های ۳۰ برابر بزرگ‌تر پیشی گرفت

مدل ZGCM-1: برتری مدل ۷ میلیارد پارامتری بر غول‌های ۳۰ برابری

تیم ZGCM مدل ۷ میلیارد پارامتری ZGCM-1 را منتشر کرد که در استدلال ریاضی و جست‌وجوی عامل‌محور از مدل‌های غول‌پیکر پیشی می‌گیرد. این مدل با استفاده از رویکرد «تحقیق و توسعه هوش…

۵ دقیقه خواندن۱
عامل کدنویسی که دنیایی را می‌سازد که در آن قضاوت می‌شود
آموزش کاربردی

تولید داده‌های آزمون توسط عامل‌های کدنویس، خطاهای منطقی را پنهان می‌کند

عامل‌های کدنویس با تولید هم‌زمان کد و داده‌های آزمون بر اساس یک برداشت اشتباه، نرم‌افزارهای «سازگار اما غلط» می‌سازند. رویکرد جدید مدل‌محور با جداسازی دنیای آزمون از کد، این…

۷ دقیقه خواندن۱