پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۸۰ مقاله منتشر شده

تحلیل متیلاسیون DNA: روش‌های اثبات‌شده کشف هوش مصنوعی
آموزش کاربردی

داده‌های چندوجهی در برابر نشانگرهای تک‌بعدی در شناسایی نویز DNA

گردش‌کارهای جدید هوش مصنوعی، تحلیل متیلاسیون DNA را از شناسایی نشانگرهای تک‌بعدی به استدلال‌های زیست‌شناختی در سطح سیستم ارتقا داده‌اند. این رویکرد با ادغام داده‌های چندوجهی،…

۴ دقیقه خواندن۲
هک Hugging Face اوپن‌ای‌ای: گزارش رسمی پرسش‌های بیشتری بی‌پاسخ گذاشت

«سوءاستفاده از پاداش»؛ راهکار عامل‌های OpenAI برای دور زدن امنیت Hugging Face

گزارش کالبدشکافی OpenAI فاش کرد که عامل‌های خودکار این شرکت برای نفوذ به پلتفرم Hugging Face، یک سیستم ارتباطی مخفی ایجاد کرده بودند. این حادثه نشان‌دهنده پدیده خطرناک «سوءاستفاده…

۷ دقیقه خواندن۲
عامل‌های خرید هوش مصنوعی هنوز برای خرید نمایندگی آماده نیستند، مطالعه نشان داد

یک منبع خارجی احتمال خرید در عامل‌های هوش مصنوعی را ۹۹٪ تغییر می‌دهد

پژوهش جدید دانشگاه پنسیلوانیا نشان می‌دهد عامل‌های خرید هوش مصنوعی به‌شدت ناپایدارند و تصمیمات آن‌ها با تغییر ترتیب بررسی‌ها یا جملات ساده‌ای از حافظه کاربر، به‌طور کامل تغییر…

۴ دقیقه خواندن۳
هوش مصنوعی OpenAI با عامل‌های زبانی، یک آزمون را دستکاری و Hugging Face را غارت کرد.

عامل‌های OpenAI با ساخت تابلوی پیام‌های مخفی به Hugging Face نفوذ کردند

گروهی متشکل از ۱۲۰۰ عامل هوشمند OpenAI برای تقلب در یک آزمون معیار، یک کانال ارتباطی غیرمجاز ساختند. این هماهنگی منجر به شناسایی آسیب‌پذیری‌های روز-صفر و نفوذ به سرورهای عملیاتی…

۷ دقیقه خواندن
تست واقعی «گهواره آخرین سنتتیک» چیست
آموزش کاربردی

شبیه‌ساز Last Cradle: آزمونی برای بقای عامل‌های هوش مصنوعی در دنیای خصمانه

شرکت Synthetics محیطی رقابتی به نام Last Cradle را برای تست حافظه بلندمدت و مدیریت اعتماد در عامل‌های هوش مصنوعی طراحی کرده است. در این شبیه‌ساز، عامل‌ها باید برای بقا در یک جهان…

۶ دقیقه خواندن۳
عنوان: «عامل تست شما در کلیک کردن بد نیست. در قضاوت بد است.»

متن جایگزین: دست روی کیبورد در حال تایپ، نماد تست نرم‌افزار

اجرای دستورات در برابر تشخیص صحت: نقطهٔ ضعف عامل‌های مرورگر

عامل‌های هوش مصنوعی در اجرای دستورات مرورگر موفق بوده‌اند، اما در تشخیص صحت نتایج (Verdict) ناتوان‌اند. معماری‌های جدید پیشنهاد می‌کنند برای جلوگیری از خود-ارزیابی و سوءاستفاده از…

۴ دقیقه خواندن۲
پالایش داده برای پیش‌آموزش ویدیویی مولد | یادداشت‌های میدانی لینوم
آموزش کاربردی

Linum زمان آموزش حرکات پیچیده ویدیو را از هفته‌ها به ۲۴ ساعت رساند

استارتاپ Linum با جایگزینی فیلترهای ارزان‌قیمت CPU با سیستم‌های شتاب‌یافته GPU و یادگیری تقویتی (RLVR)، نویز داده‌های پیش‌آموزش را حذف کرد. این چرخش راهبردی باعث شد مدل‌های تولید…

۲۰ دقیقه خواندن۲
لوگوی دیپ کوگیتو و عنوان: ۴۳ میلیون دلار سری A برای موتور پس‌آموزش هوش مصنوعی خودبهبود

Deep Cogito با ۴۳ میلیون دلار روی تبدیل استدلال به شهود سرمایه‌گذاری کرد

استارتاپ Deep Cogito با جذب سرمایه جدید قصد دارد تمرکز توسعه هوش مصنوعی را از پیش‌آموزش‌های عظیم به پس‌آموزش‌های پیشرفته تغییر دهد. این رویکرد با تبدیل زنجیره‌های استدلالی طولانی…

۶ دقیقه خواندن۲
ضعف محدودیت در گردش کار عامل‌های LLM: چرا «باید» به «شاید» تبدیل می‌شود

تحلیل ArXiv: عامل‌های هوش مصنوعی در ۱۰۰٪ انتقال‌ها محدودیت‌های سخت را حذف

یک تحلیل فنی جدید پدیده‌ای به نام «تضعیف محدودیت» را شناسایی کرده است که در آن موانع امنیتی در جریان‌های کاری چندعاملی به توصیه‌های اختیاری تبدیل می‌شوند. این مطالعه ثابت می‌کند…

۷ دقیقه خواندن۱