پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۷۵ مقاله منتشر شده

کارایی استفاده عامل‌های هوشمند از روش‌های آزمون و تأیید چقدر است؟

تأیید رسمی در برابر استدلال مدل‌ها؛ شکافی در یافتن باگ‌های پیچیده

تحلیلی فنی نشان می‌دهد عامل‌های هوش مصنوعی حتی با دستورات صریح، قادر به استفاده مؤثر از کتابخانه‌های تست پیشرفته یا متدهای تأیید رسمی نیستند. این مدل‌ها به‌جای یافتن باگ‌های…

۵۱ دقیقه خواندن۱
خلاصه پژوهش‌های هوش مصنوعی/یادگیری ماشین — ۱۵ شهریور ۱۴۰۵

«کاهش هزینه‌های استنتاج»؛ دستاورد متدهای جدید در بهینه‌سازی مدل‌های زبانی

پژوهش‌های جدید نشان می‌دهند که می‌توان بدون به‌روزرسانی کامل وزن‌های مدل، هزینه‌های استنتاج را به‌شدت کاهش داد. متدهای WHALE و Random Attention با بهینه‌سازی پرامپت‌ها و تغییر در…

۴ دقیقه خواندن۲
پرسش از HN: شرکت Fable پیانوی من را هک کرده، آیا می‌توانم نتایج را منتشر کنم؟
آموزش کاربردیتأییدنشده · منبع منفرد

درون فرآیند مهندسی معکوس فرمت‌های اختصاصی PianoDisc Protigy

یک کاربر با استفاده از هوش مصنوعی Fable توانست فرمت موسیقی اختصاصی پیانوهای خودنواز PianoDisc Protigy را مهندسی معکوس کند. این ابزار نه تنها داده‌های MIDI پنهان در فایل‌های MP3 را…

۲ دقیقه خواندن
موتور ریاضی چندموتوره مبتنی بر شواهد برای مدل‌های زبانی بزرگ: محاسبه دقیق، نمادین، رسمی، بازه‌ای-گواهی‌شده و عددی با MathIR ت
آموزش کاربردی

چگونه MathKernel با ردپای کامل، محاسبات مدل‌های زبانی را تضمین می‌کند؟

سامانه MathKernel با تفکیک قصد ریاضی (توسط LLM) از اجرای محاسبات (توسط موتورهای تأییدشده)، توهمات عددی را حذف می‌کند. این ابزار یک مدل اعتماد سخت‌گیرانه و ردپای کامل برای هر…

۴۱ دقیقه خواندن۱
بازرسی هوشمند قراردادهای هوشمند با هوش مصنوعی در ۲۰۲۶
آموزش کاربردی

ترکیب تحلیل ایستا و مدل‌های زبانی، بازرسی قراردادهای هوشمند را خودکار کرد

بازرسی قراردادهای هوشمند در سال ۲۰۲۶ به یک خط لوله ترکیبی تبدیل شده است که ابزارهای تحلیل ایستا را با مدل‌های زبانی بزرگ برای شناسایی خطاهای منطقی ادغام می‌کند. این رویکرد به…

۲ دقیقه خواندن
اثبات قضیه آخر فرما در نرم‌افزار اثبات‌ساز لیان توسط کلود فرمالی شد.

مدل پژوهشی آنتروپیک قضیه آخر فرمات را در زبان Lean 4 فرمال کرد

یک مدل داخلی آنتروپیک طی ۱۱ روز به‌صورت خودگردان، اثبات اندرو وایلز برای قضیه آخر فرمات را به زبان Lean 4 تبدیل کرد. این دستاورد مدیون لایه هماهنگی Prove2Me است که امکان حفظ حافظه…

۸ دقیقه خواندن
آیا ریاضیات در آستانه ورود به موزه است؟

«آسیب‌پذیری ریاضیات محض»؛ دستاورد جدید پژوهشگران چینی با کمک Codex

پژوهشگران دانشگاه هونان با کمک مدل Codex توانستند حدس کروی هادویگر را که از سال ۱۹۷۴ باز بود، اثبات کنند. این دستاورد نشان می‌دهد که حتی پیچیده‌ترین حوزه‌های ریاضیات محض نیز در…

۴ دقیقه خواندن۱
پژوهشگر کارآموز خودکار اوپن‌ای‌ای در حال تحلیل داده‌ها روی صفحه نمایشگر

عامل‌های OpenAI چگونه حجم کارهای پژوهشی را به ۳.۱ برابر رساندند؟

OpenAI با دستیابی به هدف ساخت «کارآموز پژوهشی خودکار»، حجم عملیات داخلی خود را به شدت افزایش داده است. اکنون در سازمان پژوهشی این شرکت، هر یک روز کاری انسان با بیش از سه روز تلاشِ…

۶ دقیقه خواندن۱