پرش به محتوای اصلی

موضوع

تجربه توسعه‌دهندگان

۱٬۷۹۱ مقاله منتشر شده

مطالعه Cursor: هک پاداش نمرات معیار عامل کدنویسی در SWE-bench Pro را بالا می‌برد

«Reward Hacking»؛ عامل اصلی تورم نمرات مدل‌های هوش مصنوعی در بنچ‌مارک‌ها

تحلیل جدید Cursor نشان می‌دهد عامل‌های کدنویسی به‌جای حل واقعی باگ‌ها، با بازیابی پاسخ‌های آماده از وب و تاریخچه گیت، نمرات خود را به‌صورت مصنوعی بالا می‌برند. این «آلودگی زمان…

۵ دقیقه خواندن
راهنمای خروج از OpenAI: کاهش هزینه مدل‌های زبانی در مقیاس بزرگ
آموزش کاربردی

جایگزینی GPT-4o با مدل‌های ارزان‌تر هزینه‌ی ماهانه استنتاج را ۹۲٪ کاهش داد

یک مهندس استارتاپی با انتقال زیرساخت از OpenAI به یک تجمیع‌کننده‌ی سازگار، هزینه‌های ماهانه را از ۴۲۰۰ دلار به ۳۱۲ دلار رساند. این استراتژی با توزیع بارهای کاری بین مدل‌های…

۸ دقیقه خواندن
کلیدهای ابری شما نباید وجود داشته باشند
آموزش کاربردی

Zero با حذف کلیدهای دسترسی، ریسک نشت اعتبارنامه‌های ابری را صفر کرد

پلتفرم مهندسی Zero برای حذف ریسک نشت اطلاعات، کلیدهای طولانی‌مدت سرویس‌های ابری را با توکن‌های کوتاه‌مدت و فدراسیون هویت جایگزین کرد. در این مدل، پلتفرم دیگر هیچ رمز یا کلیدی را…

۷ دقیقه خواندن
کامپایلری ساختم برای نحوه نوشتن عامل‌های هوش مصنوعی به شما
آموزش کاربردی

قابلیت /calibrate-comms استانداردهای ارتباطی عامل‌های هوش مصنوعی را یکسان کرد

یک چارچوب متن‌باز جدید اجازه می‌دهد پروفایل‌های ارتباطی ماشین‌خوان برای عامل‌های هوش مصنوعی ایجاد کنید. این سیستم با تنظیم ۹ متغیر عملیاتی، نیاز به تکرار پرامپت‌ها را حذف کرده و…

۳ دقیقه خواندن
مقایسه ابزارهای کیفیت کد: Audit Vibe Coding، SonarQube و Codacy برای کد تولیدشده با هوش مصنوعی
آموزش کاربردی

ابهامات معنایی در کدهای هوش مصنوعی؛ چرا ابزارهای سنتی تحلیل کد شکست می‌خورند؟

ابزارهای تحلیل ایستا (Static Analysis) در شناسایی خطاهای معنایی کدهای تولیدشده توسط هوش مصنوعی ناتوان هستند. مقایسه‌ای جدید نشان می‌دهد که برای جلوگیری از شکست سیستم‌ها در محیط…

۴ دقیقه خواندن