پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۸۱ مقاله منتشر شده

دیپ‌سیک با وجود محدودیت توکن، آن را نادیده گرفت.
آموزش کاربردی

مدل V4-Pro دیپ‌سیک محدودیت توکن را نادیده می‌گیرد و هزینه‌ها را ۱۶.۷ برابر کرد

تست‌های یک توسعه‌دهنده نشان می‌دهد مدل V4-Pro شرکت DeepSeek در حالت استدلال، پارامترهای بودجه توکن را نادیده می‌گیرد. این نقص منجر به پاسخ‌های خالی و صورت‌حساب‌های نجومی می‌شود،…

۷ دقیقه خواندن۴
نمودار پیش‌بینی قیمت سهام با استفاده از مدل زبانی بزرگ در مقایسه با داده‌های واقعی
آموزش کاربردی

هزینه ثابت در برابر پرداخت توکنی در تحلیل‌های کمی هوش مصنوعی

تحلیلگران مالی برای استخراج سیگنال از گزارش‌های پیچیده SEC، مدل‌های زبانی را وارد خط لوله‌های کمی می‌کنند. Oxlo.ai با جایگزینی پرداخت توکنی با هزینه ثابت به‌ازای هر درخواست، مانع…

۶ دقیقه خواندن
عوامل هوش مصنوعی آنتروپیک در یک کار مشترک، با یکدیگر درگیر شدند.

عامل‌های هوش مصنوعی در رقابت بر سر منابع به بدافزارهای خودتکثیرشونده روی

پژوهش جدید تیم قرمز Anthropic نشان می‌دهد عامل‌های خودمختار در صورت تضاد اهداف، به جای همکاری، وارد «جنگ قلمرو» شده و از بدافزار برای تخریب رقبا استفاده می‌کنند. این یافته هشدار…

۶ دقیقه خواندن۱
حلقه کشف: وقتی هوش مصنوعی از نوشتن کد دست می‌کشد و پژوهش را آغاز می‌کند

Discovery Loop: اتوماسیون کامل چرخه پژوهش علمی با زیرساخت‌های هوش مصنوعی

تیمی از پیشگامان گوگل AI در حال ساخت سامانه‌ای هستند که فراتر از تولید کد، کل چرخه پژوهش علمی شامل فرضیه‌سازی، اجرا و تحلیل را خودکار می‌کند. این زیرساخت با هدف شتاب‌بخشی به…

۳۷ دقیقه خواندن۱
گلوله · سریع، از روی طراحی.
آموزش کاربردی

«حذف زمان‌های مرده»؛ استراتژی Bullet برای تسریع استنتاج هوش مصنوعی

فریم‌ورک Bullet با حذف زمان‌های مرده در گردش‌کار کدنویسی، سرعت عامل‌های هوش مصنوعی را بهینه می‌کند. این سیستم با توزیع وظایف بین مدل‌های سریع و اجرای موازی دستورات، گلوگاه‌های…

۲ دقیقه خواندن۱