پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۶ مقاله منتشر شده

شتاب در پژوهش: نگاهی به درون OpenAI

عامل‌های OpenAI برای هر یک روز کار انسانی، ۳.۱ روز تلاش تولید می‌کنند

اوپن‌ای‌آی با استقرار «کارآموز پژوهشی خودکار» گامی concrete به سوی بهبود خودکار بازگشتی (RSI) برداشت. داده‌های داخلی نشان می‌دهد عامل‌های کدنویسی اکنون حجم کاری معادل ۳.۱ روز را…

۱۰ دقیقه خواندن۱
ذهنی فرازمینی: نمایش هنری از آگاهی غیرانسانی با اشکال هندسی درخشان و رنگ‌های فراطبیعی.

OpenAI روی خودبه‌بهبود بازگشتی و دفاع مقیاس‌پذیر متمرکز شد

شرکت OpenAI هشدار داد که هوش مصنوعی به مرحله‌ای از خودبه‌بهبود بازگشتی رسیده است که در آن ماشین‌ها توسعه خود را هدایت می‌کنند. این شرکت اکنون اولویت خود را بر «دفاع مقیاس‌پذیر»…

۱۳ دقیقه خواندن
پیشرفت خودبهبودی بازگشتی هوش مصنوعی کندتر از پیش‌بینی‌هاست

«توقف انفجار هوش»؛ موانع فنی در مسیر تکامل خودکار مدل‌ها

تحلیلی جدید نشان می‌دهد سیستم‌های هوش مصنوعی که قادر به آموزش نسخه‌های بعدی خود بدون دخالت انسان هستند، بسیار کندتر از پیش‌بینی‌های نظریه تکینگی پیش می‌روند. گلوگاه‌های فنی در…

۱۰ دقیقه خواندن۱
چرا پرامپت‌هایتان شکست می‌خورند (و آناتومیِ کارساز)
آموزش کاربردی

چرا جایگاه اطلاعات در توالی متنی بر دقت پاسخ مدل اثر می‌گذارد

بسیاری از خطاهای مدل‌های زبانی ناشی از «منحنی U-شکل» در توجه مدل است که باعث نادیده گرفتن اطلاعات میانی پرامپت می‌شود. برای حل این مشکل، باید ساختاری سخت‌گیرانه شامل نقش، وظیفه و…

۱۰ دقیقه خواندن۲
صدای الگوریتمی: چگونه هوش مصنوعی زبان را می‌سازد و معنا را می‌دزدد

بررسی تحلیلی: ظهور رفتارهای نوظهور در مدل‌ها بدون دخالت صریح توسعه‌دهنده

بررسی پدیده‌ی «شهود» در مدل‌های زبانی که فراتر از دستورات صریح توسعه‌دهندگان شکل می‌گیرد. این تحلیل نشان می‌دهد ارزشمندترین رفتارهای هوش مصنوعی، همان‌هایی هستند که به‌طور تصادفی و…

۱ دقیقه خواندن
هوش مصنوعی: ترکیبی از شگفتی، نگرانی و امید برای آینده.
زندگی با AI

تحلیل یک توسعه‌دهنده: رشد هوش مصنوعی با فساد زیرساختی جامعه همسو نیست

یک توسعه‌دهنده نرم‌افزار از پارادوکس هوش مصنوعی می‌گوید؛ جایی که توانایی‌های استدلالی مدل‌ها با تخریب محیط‌زیست و نابودی وب آزاد پیش می‌رود. این تحلیل استدلال می‌کند که پیروزی‌های…

۲ دقیقه خواندن
مدل‌های هوش مصنوعی ۲۰۲۶: فیبل ۵.۱، آسترا و چالش چین

آیا قیمت‌های نزدیک به صفر مدل‌های وزن‌باز، تسلط غرب را می‌شکند؟

رقابت در دنیای هوش مصنوعی از افزایش اندازه مدل‌ها به سمت بهینه‌سازی شدید هزینه‌ها تغییر مسیر داده است. در حالی که مدل‌های غربی بر قدرت و ایمنی تمرکز دارند، مدل‌های وزن‌باز چینی با…

۹ دقیقه خواندن
شش پیشرفت کلیدی مدل جهان JEPA برای توقف توهمات مدل‌های زبانی بزرگ
آموزش کاربردی

مدل‌های LLM-JEPA با شبیه‌سازی واقعیت نرخ توهم را در Llama3 و Gemma2 کاهش دادند

چارچوب جدید LLM-JEPA با ترکیب مدل‌های زبانی و معماری‌های پیش‌بینِ جاسازی مشترک، به جای پیش‌بینی توکن‌ها به شبیه‌سازی واقعیت در فضای انتزاعی روی آورده است. این رویکرد باعث بهبود…

۵ دقیقه خواندن
مقایسه عملکرد کدنویسی سه مدل هوش مصنوعی برتر در تست عملی
آموزش کاربردی

۸ محک عملی برای سنجش دقت مدل‌های کدنویسی در محیط تولید

مقایسه مدل‌های پیشرو با پرامپت‌های ساده منجر به شکست‌های هزینه‌بر در محیط عملیاتی می‌شود. چارچوب ارزیابی جدید، تمرکز را از «زیبایی کد» به رعایت محدودیت‌ها، آگاهی از ساختار مخزن و…

۱۹ دقیقه خواندن