پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۹ مقاله منتشر شده

تست واقعی «گهواره آخرین سنتتیک» چیست
آموزش کاربردی

شبیه‌ساز Last Cradle: آزمونی برای بقای عامل‌های هوش مصنوعی در دنیای خصمانه

شرکت Synthetics محیطی رقابتی به نام Last Cradle را برای تست حافظه بلندمدت و مدیریت اعتماد در عامل‌های هوش مصنوعی طراحی کرده است. در این شبیه‌ساز، عامل‌ها باید برای بقا در یک جهان…

۶ دقیقه خواندن۲
عنوان: «عامل تست شما در کلیک کردن بد نیست. در قضاوت بد است.»

متن جایگزین: دست روی کیبورد در حال تایپ، نماد تست نرم‌افزار

اجرای دستورات در برابر تشخیص صحت: نقطهٔ ضعف عامل‌های مرورگر

عامل‌های هوش مصنوعی در اجرای دستورات مرورگر موفق بوده‌اند، اما در تشخیص صحت نتایج (Verdict) ناتوان‌اند. معماری‌های جدید پیشنهاد می‌کنند برای جلوگیری از خود-ارزیابی و سوءاستفاده از…

۴ دقیقه خواندن۲
پالایش داده برای پیش‌آموزش ویدیویی مولد | یادداشت‌های میدانی لینوم
آموزش کاربردی

Linum زمان آموزش حرکات پیچیده ویدیو را از هفته‌ها به ۲۴ ساعت رساند

استارتاپ Linum با جایگزینی فیلترهای ارزان‌قیمت CPU با سیستم‌های شتاب‌یافته GPU و یادگیری تقویتی (RLVR)، نویز داده‌های پیش‌آموزش را حذف کرد. این چرخش راهبردی باعث شد مدل‌های تولید…

۲۰ دقیقه خواندن۱
لوگوی دیپ کوگیتو و عنوان: ۴۳ میلیون دلار سری A برای موتور پس‌آموزش هوش مصنوعی خودبهبود

Deep Cogito با ۴۳ میلیون دلار روی تبدیل استدلال به شهود سرمایه‌گذاری کرد

استارتاپ Deep Cogito با جذب سرمایه جدید قصد دارد تمرکز توسعه هوش مصنوعی را از پیش‌آموزش‌های عظیم به پس‌آموزش‌های پیشرفته تغییر دهد. این رویکرد با تبدیل زنجیره‌های استدلالی طولانی…

۶ دقیقه خواندن۲
ضعف محدودیت در گردش کار عامل‌های LLM: چرا «باید» به «شاید» تبدیل می‌شود

تحلیل ArXiv: عامل‌های هوش مصنوعی در ۱۰۰٪ انتقال‌ها محدودیت‌های سخت را حذف

یک تحلیل فنی جدید پدیده‌ای به نام «تضعیف محدودیت» را شناسایی کرده است که در آن موانع امنیتی در جریان‌های کاری چندعاملی به توصیه‌های اختیاری تبدیل می‌شوند. این مطالعه ثابت می‌کند…

۷ دقیقه خواندن
نوار ابزار ویندوز با دکمه‌های میکروفون و کیبورد، نشان‌دهنده فعال‌سازی صوتی Codex
آموزش کاربردی

«فراتر از تحلیل احساسات»؛ رویکرد جدید NLP در استخراج سیگنال‌های بازار

پردازش زبان طبیعی (NLP) در حوزه مالی از امتیازدهی ساده به احساسات فراتر رفته و اکنون بر تحلیل لحن، عدم قطعیت و بستر کلام در گزارش‌های مالی تمرکز دارد. تیم‌های کوانت با تفکیک سخنان…

۴ دقیقه خواندن۱
هوش مصنوعی هنوز برای کار واقعی آماده نیست: چرا مدل‌ها در وظایف پیچیده مردود می‌شوند

پژوهش برکلی: نرخ موفقیت عامل‌های هوش مصنوعی در وظایف تخصصی زیر ۲۵٪ است

تحقیقات جدید نشان می‌دهد مدل‌های پیشرو در مواجهه با وظایفی که تخصص سطح ارشد را می‌طلبد، به‌طور کامل شکست می‌خورند. در حالی که هوش مصنوعی در پیش‌نویس‌های اولیه مفید است، تکیه به آن…

۴ دقیقه خواندن
ساندار سوبرامانیان، مدیرعامل زایتر - مصاحبه اختصاصی

مدیرعامل Zyter: هوش مصنوعی عامل‌محور باید جریان‌های کاری را بازطراحی کند

شرکت Zyter از اتوماسیون ساده فاصله گرفته و به سمت ایجاد یک «لایه اجرا» برای هماهنگی میان عامل‌ها، انسان‌ها و داده‌های سازمانی حرکت می‌کند. ساندار سوبرامانیان معتقد است شکست صنعت…

۱۱ دقیقه خواندن۳