پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۸۲ مقاله منتشر شده

چگونه NCO بدون «انفجار حالت»، محتوای ممنوعه را در مدل‌های زبانی حذف می‌کند؟

چگونه NCO بدون «انفجار حالت»، محتوای ممنوعه را در مدل‌های زبانی حذف می‌کند؟

پژوهشگران راهکاری به نام NCO را معرفی کرده‌اند که از طریق تطبیق آنلاین الگوها، مانع تولید محتوای ممنوعه در مدل‌های زبانی می‌شود. این روش برخلاف متدهای پیشین، مشکل «انفجار حالت»…

۲ دقیقه خواندن۱
«پاک» پردازشی؛ استراتژی اپل برای تبدیل آیفون به منبع انرژی عینک‌های هوشمند

«پاک» پردازشی؛ استراتژی اپل برای تبدیل آیفون به منبع انرژی عینک‌های هوشمند

اپل در حال تغییر استراتژی از تمرکز بر گوشی به پلتفرم‌های رایانش محیطی است. در این مدل، آیفون به یک مرکز پردازش و باتری تبدیل می‌شود تا عینک‌های هوشمند سبک‌تر و کاربردی‌تر شوند.

۲ دقیقه خواندن۳
چرا شخصیت سام آلتمن هیچ اهمیتی در بقای بشر در عصر AGI ندارد؟

چرا شخصیت سام آلتمن هیچ اهمیتی در بقای بشر در عصر AGI ندارد؟

بری دیلر، میلیاردر مشهور، هشدار می‌دهد که تمرکز بر اخلاقیات مدیران هوش مصنوعی یک خطای استراتژیک است. او معتقد است ماهیت پیش‌بینی‌ناپذیر هوش مصنوعی عام، هرگونه اعتماد شخصی به…

۲ دقیقه خواندن۱
چگونه یک حسابرسی سه‌مرحله‌ای، توهمات پنهان در خط لوله ارزیابی LLM را افشا کرد؟
آموزش کاربردی

چگونه یک حسابرسی سه‌مرحله‌ای، توهمات پنهان در خط لوله ارزیابی LLM را افشا کرد؟

بررسی‌های جدید روی ابزار Langfuse نشان می‌دهد که رفع باگ‌های زیرساختی، پیش‌شرط ارزیابی دقیق مدل‌ها است. این فرآیند فاش کرد که برخی مدل‌ها با تکرار عیناً متن پرامپت، داوران خودکار…

۲ دقیقه خواندن۳
تکه‌بندی تطبیقی اقدامات: راهکاری برای حذف محدودیت طول توالی در یادگیری تقویت‌شده

تکه‌بندی تطبیقی اقدامات: راهکاری برای حذف محدودیت طول توالی در یادگیری تقویت‌شده

الگوریتم جدید ACH با جایگزینی توالی‌های ثابت با مکانیزم‌های پویا، اجازه می‌دهد عامل‌های RL طول توالی اقدامات را بر اساس وضعیت محیط تغییر دهند. این رویکرد در ۳۴ تکلیف پیچیده،…

۲ دقیقه خواندن۳
حذف تأخیر در واکنش ربات‌ها: سازوکار جریانی SSIP جایگزین معماری تکه‌ای شد

حذف تأخیر در واکنش ربات‌ها: سازوکار جریانی SSIP جایگزین معماری تکه‌ای شد

پژوهشگران با معرفی سیاست درون‌روند استوکاستیک (SSIP)، تأخیرهای بحرانی در معماری‌های تکه‌ای ربات‌ها را حذف کردند. این چارچوب امکان کنترل آنی و واکنش به موانع را بدون نیاز به…

۲ دقیقه خواندن۱
رویکرد معکوس در وزن‌دهی: راهکاری برای حل نابرابری در داده‌های Long-Tailed

رویکرد معکوس در وزن‌دهی: راهکاری برای حل نابرابری در داده‌های Long-Tailed

پژوهشگران روشی جدید برای مدیریت داده‌های نامتوازن معرفی کرده‌اند که وزن‌دهی زیان را به عنوان یک مسئله معکوس تعریف می‌کند. این استراتژی با استفاده از هندسه‌ی Neural Collapse، تعادل…

۲ دقیقه خواندن۱
پروتکل BLEEP: پذیرش پهنای باند ۸۷ مگابایت بر ثانیه برای بقای کوانتومی

پروتکل BLEEP: پذیرش پهنای باند ۸۷ مگابایت بر ثانیه برای بقای کوانتومی

پروتکل BLEEP یک بلاک‌چین «پسا-کوانتومی از بدو تأسیس» برای مقابله با بحران «اکنون برداشت کن، بعداً رمزگشایی کن» (HNDL) است. این شبکه با پیاده‌سازی استانداردهای سطح ۵ NIST، ریسک…

۲ دقیقه خواندن۱
چرا ۶۸٪ از استقرار‌های ابری هوش مصنوعی دچار نشت رمزنگاری می‌شوند؟
آموزش کاربردی

چرا ۶۸٪ از استقرار‌های ابری هوش مصنوعی دچار نشت رمزنگاری می‌شوند؟

بیشتر نشت‌های داده در عامل‌های هوش مصنوعی نه به دلیل ضعف پروتکل‌ها، بلکه بر اثر پیکربندی غلط کلیدها و نادیده گرفتن متادیتا رخ می‌دهد. این راهنما روش‌های پیاده‌سازی پروتکل‌های…

۲ دقیقه خواندن۱
سازوکار حافظه یکپارچه: حذف گلوگاه‌های معنایی برای استدلال عامل‌محور در 6G

سازوکار حافظه یکپارچه: حذف گلوگاه‌های معنایی برای استدلال عامل‌محور در 6G

یک معماری پیشنهادی برای شبکه‌های 6G، رابط‌های سنتی پیام‌رسانی را با پارادایم حافظه‌محور جایگزین می‌کند. این تغییر به عامل‌های هوش مصنوعی اجازه می‌دهد بدون اتلاف داده‌های ناشی از…

۲ دقیقه خواندن۱
بنچمارک‌های کدنویسی چگونه Claude 4.7 را به یک برنامه‌نویس ناکارآمد تبدیل کردند؟
زندگی با AI

بنچمارک‌های کدنویسی چگونه Claude 4.7 را به یک برنامه‌نویس ناکارآمد تبدیل کردند؟

مدل Claude 4.7 به جای استفاده از کتابخانه‌های استاندارد پایتون، آن‌ها را از ابتدا بازنویسی کرده و حجم پروژه را بی‌دلیل افزایش داده است. این اتفاق نشان می‌دهد بنچمارک‌های فعلی، هوش…

۲ دقیقه خواندن۳
تزریق پارالینگویستیک: ارتقای دقت تشخیص بحران‌های روانی در LLMها به ۸۰.۵٪

تزریق پارالینگویستیک: ارتقای دقت تشخیص بحران‌های روانی در LLMها به ۸۰.۵٪

پژوهشگران چارچوبی برای مدل‌های زبانی توسعه داده‌اند که با تزریق نشانه‌های احساسی غیرکلامی به متن گفتگو، سطح بحران‌های روانی را شناسایی می‌کند. این سیستم با ترکیب تحلیل‌های صوتی و…

۲ دقیقه خواندن۱