پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۰۹۸ مقاله منتشر شده

۱۸۱ اکسپلویت در برابر ۲ مورد؛ جهش تکان‌دهنده Claude Mythos در شکار باگ

۱۸۱ اکسپلویت در برابر ۲ مورد؛ جهش تکان‌دهنده Claude Mythos در شکار باگ

مدل جدید Anthropic با شناسایی حفره‌های امنیتی چنددهه-ساله در سخت‌گیرانه‌ترین سیستم‌ها، مفهوم امنیت را تغییر داد. اکنون رقابت از «یافتن باگ» به «سرعت در وصله کردن» تبدیل شده است.

۳ دقیقه خواندن
برتری تکان‌دهنده o1 در اورژانس؛ آیا استدلال جایگزین تخصص پزشکی می‌شود؟

برتری تکان‌دهنده o1 در اورژانس؛ آیا استدلال جایگزین تخصص پزشکی می‌شود؟

مدل استدلالی جدید OpenAI در تشخیص‌های پزشکی و موارد واقعی اورژانس، پزشکان انسانی را شکست داد. این نتیجه ثابت می‌کند که معماری زنجیره تفکر بدون نیاز به آموزش‌های تخصصی، می‌تواند…

۳ دقیقه خواندن
۱۰ برابر ارزان‌تر؛ Grok 4.3 و استراتژی تهاجمی xAI برای تسخیر بازار

۱۰ برابر ارزان‌تر؛ Grok 4.3 و استراتژی تهاجمی xAI برای تسخیر بازار

مدل Grok 4.3 با تمرکز بر بهینه‌سازی شدید هزینه‌ها و قابلیت‌های استدلالی داخلی عرضه شد. این مدل اگرچه در هوش خام از رقبای پیشرو عقب‌تر است، اما با قیمت بسیار پایین و حالت جدید…

۳ دقیقه خواندن