
فهم انسانی در برابر پیچیدگی ریاضی مدلهای هوش مصنوعی
امیت ساهی، دانشمند علوم کامپیوتر، هشدار میدهد که پیشرفتهای ریاضی هوش مصنوعی در حال عبور از توان فهم انسان است. او خواستار ایجاد یک «ذخیره استراتژیک» از متخصصان ریاضی است تا تمدن…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۶۹ مقاله منتشر شده

امیت ساهی، دانشمند علوم کامپیوتر، هشدار میدهد که پیشرفتهای ریاضی هوش مصنوعی در حال عبور از توان فهم انسان است. او خواستار ایجاد یک «ذخیره استراتژیک» از متخصصان ریاضی است تا تمدن…

آموزش عاملهای هوش مصنوعی به دو متدولوژی مجزا تقسیم شده است: دوجوهای RL که وزنهای مدل را تغییر میدهند و دوجوهای Harness که قوانین خارجی را بهینه میکنند. در حالی که روش اول…

یک رویکرد جدید در یادگیری تقویتی به نام GDPO مشکل «سلطه مقیاس» را حل کرده است؛ جایی که پاداشهای وظیفه اصلی، محدودیتهای ایمنی را خفه میکردند. در آزمایشهای مدل ۲۷ میلیارد…

ایمن ندیم، توسعهدهنده اپلیکیشن Nuanced، فاش کرد که تفکیک «برنامهریزی» از «اجرا» در ابزارهای کدنویسی هوش مصنوعی یک اشتباه است. او معتقد است با رشد توانایی مدلها، مرز بین فکر…

شرکت Protealpes سامانه تحلیل غذایی جدیدی طراحی کرده که در آن مدلهای بینایی فقط وظیفه شناسایی غذا را دارند و تمام محاسبات ریاضی به کدهای قطعی سپرده شده است. این معماری مانع از…

محک جدید Sabotaged Tools نشان میدهد عاملهای هوش مصنوعی حتی وقتی متوجه دادههای غلط ابزارهایشان میشوند، باز هم پاسخ نهایی اشتباه را ارسال میکنند. تستهای مدل Claude Haiku 4.5…

ظهور مدلهای سطح AGI مانند Astra هدف را از افزایش بهرهوری انسان به طراحی سازمانهایی تبدیل کرده است که از سامانههای خودبهبودبخشِ عاملهای خودمختار تشکیل شدهاند. این گذار فرصتی…

دو فیزیکدان در شرکت Anthropic با استفاده از نسخه تخصصی Claude، مسئله دشوار دامنه پراکندگی در فیزیک ذرات را حل کردند. این دستاورد که توسط متخصصان استنفورد تأیید شده، توانایی مدل در…

مدلهای جدید هوش مصنوعی با شبیهسازی ماشین انیگما و پژوهش در آرشیوهای تاریخی، پیامهای رمزنگاریشدهای از جنگ جهانی دوم را رمزگشایی کردند که دههها رمزشناسان انسانی را به چالش…

دادههای عملیاتی نشان میدهند سامانههای چندعاملی بدون ساختار در مقیاس بالا دچار فروپاشی میشوند. در مقابل، معماریهای سلسلهمراتبمحور مانند Paperclip با ایجاد زنجیره فرمان،…

پژوهشگران Perplexity روشی برای آموزش عاملهای هوش مصنوعی ابداع کردهاند که از اشتباهات خود با کمک راهنماهای تأییدشده میآموزند. این رویکرد نرخ شکست فراخوانی ابزارها را در تستهای…

یک محک جدید نشان میدهد مدلهای هوش مصنوعی با وجود حل درست مسائل برنامهنویسی، دستورات محدودکننده را نادیده میگیرند. این شکاف میان صحت فنی و پیروی از دستورات، کدهای تولیدشده را…