پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۲ مقاله منتشر شده

۱۸۱ اکسپلویت در برابر ۲ مورد؛ جهش تکان‌دهنده Claude Mythos در شکار باگ

۱۸۱ اکسپلویت در برابر ۲ مورد؛ جهش تکان‌دهنده Claude Mythos در شکار باگ

مدل جدید Anthropic با شناسایی حفره‌های امنیتی چنددهه-ساله در سخت‌گیرانه‌ترین سیستم‌ها، مفهوم امنیت را تغییر داد. اکنون رقابت از «یافتن باگ» به «سرعت در وصله کردن» تبدیل شده است.

۳ دقیقه خواندن۲
برتری تکان‌دهنده o1 در اورژانس؛ آیا استدلال جایگزین تخصص پزشکی می‌شود؟

برتری تکان‌دهنده o1 در اورژانس؛ آیا استدلال جایگزین تخصص پزشکی می‌شود؟

مدل استدلالی جدید OpenAI در تشخیص‌های پزشکی و موارد واقعی اورژانس، پزشکان انسانی را شکست داد. این نتیجه ثابت می‌کند که معماری زنجیره تفکر بدون نیاز به آموزش‌های تخصصی، می‌تواند…

۳ دقیقه خواندن
۱۰ برابر ارزان‌تر؛ Grok 4.3 و استراتژی تهاجمی xAI برای تسخیر بازار

۱۰ برابر ارزان‌تر؛ Grok 4.3 و استراتژی تهاجمی xAI برای تسخیر بازار

مدل Grok 4.3 با تمرکز بر بهینه‌سازی شدید هزینه‌ها و قابلیت‌های استدلالی داخلی عرضه شد. این مدل اگرچه در هوش خام از رقبای پیشرو عقب‌تر است، اما با قیمت بسیار پایین و حالت جدید…

۳ دقیقه خواندن
چرا Mistral برای شکست دادن رقبای MoE، دوباره به مدل‌های متراکم روی آورد؟

چرا Mistral برای شکست دادن رقبای MoE، دوباره به مدل‌های متراکم روی آورد؟

مدل Mistral Medium 3.5 با ۱۲۸ میلیارد پارامتر، مرز بین مدل‌های استدلالی و کدنویسی را از بین برد. این مدل متراکم، پایداری عملیاتی را جایگزین تخصص‌های پراکنده کرد تا یک ابزار…

۳ دقیقه خواندن۱