پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۸۲۳ مقاله منتشر شده

قوانین جدید مهندسی زمینه برای مدل‌های نسل ۵ کلود
آموزش کاربردی

راهنمایی‌های پویا در برابر قوانین سخت‌گیرانه در استراتژی جدید Claude 5

آنتروپیک با معرفی دستورالعمل‌های جدید برای Claude 5، مهندسی پرامپت را از قوانین سخت‌گیرانه به سمت راهنمایی‌های مبتنی بر قضاوت تغییر داد. این چارچوب جدید بر افشای تدریجی داده‌ها و…

۵ دقیقه خواندن
مدل‌ها دروغ‌گوهای بدی هستند و مقاله‌ای جدید توضیح می‌دهد چرا

مدل‌های زبانی توانایی یادگیری استراتژیکِ دروغ‌گویی را ندارند

پژوهش جدید دیوید آفریقا و جیکوب پفائو نشان می‌دهد که مدل‌های زبانی فاقد سازوکار منسجم برای «ناصادق بودن» هستند. حتی با آموزش هدفمند برای دروغ گفتن، مدل‌ها تنها عادت‌های محدود کسب…

۵ دقیقه خواندن۱
۱,۳۷۷ فریم ورودی، ۶۰ فریم خروجی، و هیچ‌کس نمی‌دانست ساعت چند است.
آموزش کاربردی

ابزار crv خطای زمانی مدل‌های زبانی در تحلیل ویدیو را حذف کرد

ابزار متن‌باز crv با پیاده‌سازی ردیابی دقیق زمان‌بندی‌ها (PTS)، مشکل «لغزش زمانی» در تحلیل ویدیو توسط مدل‌های زبانی را حل کرد. این به‌روزرسانی باعث می‌شود شواهد بصری ارائه شده…

۳ دقیقه خواندن۱
آزمایش نفوذ MCP: راهنمای عملی برای امنیت زیرساخت عامل هوش مصنوعی
آموزش کاربردی

۲۵٪ از استقرارهای پروتکل MCP دارای حفره‌های امنیتی شدید هستند

تحقیقات امنیتی نشان می‌دهد از هر چهار استقرار پروتکل زمینه مدل (MCP)، یکی دارای نقاط آسیب‌پذیر شدید است. این یافته‌ها الگوهای بحرانی نشت داده و اجرای کد از راه دور را در ۸ چارچوب…

۵ دقیقه خواندن۱
عامل مرورگرم به خاطر GPT-5 کند نبود، به خاطر پرامپت‌های زباله‌وار من بود.
آموزش کاربردی

تورم پرامپت؛ دلیل واقعی کندی عامل‌های مرورگر نه محدودیت مدل‌هاست

کندی عملکرد عامل‌های مرورگر معمولاً ناشی از محدودیت‌های مدل‌هایی مثل GPT-5 نیست، بلکه نتیجهٔ «تورم پرامپت» است. ارسال داده‌های تکراری و اسکرین‌شات‌های حجیم، پنجرهٔ زمینه را اشغال…

۸ دقیقه خواندن