پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۸۸ مقاله منتشر شده

چرا مدل تخصصی Cursor هزینه برنامه‌نویسی با هوش مصنوعی را به چند سنت رساند؟

چرا مدل تخصصی Cursor هزینه برنامه‌نویسی با هوش مصنوعی را به چند سنت رساند؟

شرکت Cursor مدل Composer 2.5 را معرفی کرد که عملکرد مدل‌های گران‌قیمتی مثل GPT-5.5 را با هزینه‌ای بسیار کمتر شبیه‌سازی می‌کند. این مدل با تکیه بر داده‌های مصنوعی و یادگیری تقویتی،…

۲ دقیقه خواندن
افزایش ۳ تا ۶ برابری سرعت استنتاج مدل‌های PyTorch در مک‌های اپل سیلیکون
آموزش کاربردی

افزایش ۳ تا ۶ برابری سرعت استنتاج مدل‌های PyTorch در مک‌های اپل سیلیکون

پایتورچ یک ابزار آزمایشی به نام MLX Delegate را برای ExecuTorch منتشر کرد که سرعت اجرای مدل‌های هوش مصنوعی زاینده را در مک‌های اپل سیلیکون تا ۶ برابر افزایش می‌دهد. این ابزار با…

۲ دقیقه خواندن۳
گزارش dev.to: ۵۲٪ از کدهای تولیدشده توسط Claude Code دارای نقص امنیتی است

گزارش dev.to: ۵۲٪ از کدهای تولیدشده توسط Claude Code دارای نقص امنیتی است

بیش از نیمی از کدهای تولیدشده توسط Claude Code دارای آسیب‌پذیری‌های امنیتی هستند. در حالی که عامل‌های هوش مصنوعی در شناسایی باگ‌های قدیمی خبره‌اند، هم‌زمان ریسک‌های جدیدی را از…

۲ دقیقه خواندن۳
چرا ذخیره‌سازهای برداری برای حافظه بلندمدت عامل‌های هوش مصنوعی کافی نیستند؟
آموزش کاربردی

چرا ذخیره‌سازهای برداری برای حافظه بلندمدت عامل‌های هوش مصنوعی کافی نیستند؟

روش‌های رایج بازیابی داده در عامل‌های هوش مصنوعی با افزایش حجم اطلاعات شکست می‌خورند. معماری جدیدی با چهار لایه حافظه و یک موتور مشاهده، رویدادهای خام را به قوانین رفتاری دائمی…

۲ دقیقه خواندن۲
برتری Claude Mythos در اکسپلویت‌های مرورگر؛ بهای ۱۲ برابری برای قدرت بیشتر

برتری Claude Mythos در اکسپلویت‌های مرورگر؛ بهای ۱۲ برابری برای قدرت بیشتر

بنچمارک جدیدی نشان می‌دهد Claude Mythos در توسعه اکسپلویت‌های واقعی برای موتور V8 به‌طور قابل‌توجهی از GPT-5.5 پیشی گرفته است. با این حال، دستیابی به این سطح از توانمندی در اجرای…

۲ دقیقه خواندن۱
WorldReasonBench: شکاف دوبرابری مدل‌های تجاری و بازمتن در درک فیزیک جهان

WorldReasonBench: شکاف دوبرابری مدل‌های تجاری و بازمتن در درک فیزیک جهان

معیار جدید WorldReasonBench نشان می‌دهد که مدل‌های تجاری تولید ویدیو در استدلال جهانی دو برابر قدرتمندتر از رقبای بازمتن هستند. با این حال، تمامی مدل‌های بررسی‌شده در درک مفاهیم…

۳ دقیقه خواندن۱