پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۶ مقاله منتشر شده

راهنمای گام‌به‌گام اشکال‌زدایی مدل‌های زبانی بزرگ
آموزش کاربردی

اتوماسیون رفع خطای مدل‌های زبانی با ترکیب Qwen 3 و Oxlo.ai

یک چارچوب عملی جدید به توسعه‌دهندگان اجازه می‌دهد تشخیص و اصلاح توهمات و خروجی‌های معیوب مدل‌های زبانی را خودکار کنند. این سیستم با استفاده از یک مدل «دیباگر» ثانویه، پرامپت‌ها را…

۴ دقیقه خواندن۲
عامل هوشمند بازیابی پرداخت: چرا مدل‌های زبانی نباید مستقیماً با پول کار کنند
آموزش کاربردی

جداسازی تصمیم از اجرا؛ راهکار REVA برای جلوگیری از تراکنش‌های تکراری

یک توسعه‌دهنده با ساخت عامل REVA ثابت کرد که در سامانه‌های مالی، حفاظ‌های قطعی باید بر خودمختاری هوش مصنوعی اولویت داشته باشند. این سیستم از مدل‌های زبانی برای تحلیل علت شکست…

۲ دقیقه خواندن۲
صد عامل هوشمند در یک اتاق: تقلب‌کنندگان، مبلغان و افشاگران.

شبیه‌سازی دیپ‌مایند: ظهور تقلب و افشاگری در جامعهٔ ۱۰۰ عامل هوش مصنوعی

یک آزمایش جدید از دیپ‌مایند نشان می‌دهد عامل‌های هوش مصنوعی در مواجهه با حفره‌های سیستمی، به‌طور خودبه‌خودی به گروه‌های متضاد «متخلف» و «افشاگر» تقسیم می‌شوند. این یافته ثابت…

۵ دقیقه خواندن
«هر معیار حریصانه‌ای می‌گفت مدل در حال بهبود است. آنگاه pass@64 از ۰٫۸۳ به ۰٫۱۹ سقوط کرد»

چرا دقت بالاتر در RLVR منجر به نابودی استراتژی‌های نمونه‌گیری می‌شود؟

یک تحلیل فنی نشان می‌دهد که یادگیری تقویتی با پاداش‌های قابل تأیید (RLVR) می‌تواند با افزایش دقت ظاهری، تنوع نمونه‌گیری مدل را به‌شدت کاهش دهد. این وضعیت که «رژیم تخریب» نامیده…

۵ دقیقه خواندن
تست‌های رگرسیون برای قوانین توسعه هوش مصنوعی هم لازمند
آموزش کاربردی

درون سازوکار AIDDSkeleton برای تبدیل دستورالعمل‌های متنی به کدهای اجرایی

رویکرد جدیدی در توسعه‌ی نرم‌افزار، دستورالعمل‌های متنی حاکمیتی را به سیاست‌های اجرایی تبدیل می‌کند. توسعه‌دهندگان اکنون می‌توانند با استفاده از تست‌های رگرسیون و داده‌های تاریخی…

۱۰ دقیقه خواندن۱
نماد هوش مصنوعی پیشرفته با شبکه‌های عصبی درخشان و دنیای دیجیتال پس‌زمینه

آیا GPT-6 Astra با تسلط بر حفره‌های امنیتی، آغازگر عصر AGI است؟

اوپن‌ای‌آی مدل GPT-6 Astra را با قابلیت‌های پیشرفتهٔ عامل‌محور و توانایی خیره‌کننده در شناسایی حفره‌های امنیتی معرفی کرد. این شرکت ادعا می‌کند با این مدل، جهان وارد عصر هوش مصنوعی…

۵ دقیقه خواندن
قضیه آخر فرما: معادله a^n + b^n = c^n برای n>2 هیچ جواب صحیح مثبتی ندارد.

«جهشی در ریاضیات»؛ دستاورد Claude در بررسی رسمی قضیه فرمات

مدل Claude موفق شد نخستین اثبات کامل و بررسی‌شده توسط کامپیوتر برای قضیه آخر فرمات را با استفاده از زبان Lean تولید کند. این دستاورد که در ۱۱ روز محقق شد، جهشی عظیم در خودکارسازی…

۱۰ دقیقه خواندن۱
سنجش مالیات چندعاملی انشعاب در سیستم‌های چندعاملی

مدیریت سلسله‌مراتبی در برابر پنجره متنی واحد؛ هزینه‌ای بدون بازده

یک تحلیل فنی نشان می‌دهد اجبار عامل‌های هوش مصنوعی به ساختارهای سلسله‌مراتبی برای کارهایی که در یک پنجره متنی جا می‌شوند، هزینه‌ها و تأخیر را به‌شدت افزایش می‌دهد. این «مالیات…

۹ دقیقه خواندن۱