پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۹ مقاله منتشر شده

بهینه‌سازی ۲۳۲ برابری هسته GPU با Codex در مسئله qr_v2: از تحقیق خودکار تا اجرا
آموزش کاربردی

بهینه‌سازی هسته‌های GPU با Codex؛ دستیابی به سرعت ۲۳۲ برابر در محاسبات QR

یک توسعه‌دهنده با استفاده از مدل Codex و یک چرخه پژوهشی خودکار، سرعت اجرای هسته‌های تجزیه QR را ۲۳۲ برابر نسبت به خط‌مبنای PyTorch افزایش داد. این دستاورد نشان می‌دهد که تبدیل…

۲۴ دقیقه خواندن۲
چرا مدل‌های زبانی بزرگ توهم می‌زنند و الگوهایی که واقعاً آن را متوقف می‌کنند
آموزش کاربردی

۵ الگوی معماری برای مهار توهم در مدل‌های زبانی بزرگ

توهمات در مدل‌های زبانی، یک نقص فنی نیست بلکه نتیجه‌ی ماهیت آماری آن‌ها در پیش‌بینی توکن‌هاست. برای ساخت سامانه‌های قابل‌اعتماد، باید از نگاه به مدل به‌عنوان «ماشین پاسخ‌گو» فاصله…

۳ دقیقه خواندن۱
یک ربات با چهره درهم‌ریخته در حال شمارش انگشتانش، نمادی از اشتباهات خنده‌دار هوش مصنوعی.
زندگی با AI

سه خطای رایج هوش مصنوعی؛ چرا محدودیت‌های سخت‌گیرانه و حلقه‌های خودکار شکست

مجموعه‌ای از شکست‌های اخیر مدل‌های زبانی نشان می‌دهد که این ابزارها هنوز در درک مرزهای دقیق دستورات و مدیریت حلقه‌های بازخوردی ناتوان‌اند. این خطاها هشدار می‌دهند که اعتماد به…

۲ دقیقه خواندن۱
الگوهای معماری عامل هوشمند که در محیط عملیاتی دوام می‌آورند
آموزش کاربردی

«استقلالِ محدود»؛ شرط لازم برای خروج عامل‌های هوش مصنوعی از محیط دمو

عامل‌های هوش مصنوعی برای خروج از محیط دمو و ورود به تولید، به جای استقلال مطلق، به محدودیت‌های سخت‌افزاری و ساختاری نیاز دارند. جایگزینی حلقه‌های باز با اسکلت‌های جریان‌کاری قطعی،…

۱۳ دقیقه خواندن۲
نمودار جهت‌دار افکار: نمایش و ویرایش متن LLM به‌صورت بصری
آموزش کاربردی

گراف‌های متنی در برابر تاریخچه خطی در بهینه‌سازی پرامپت‌های هوش مصنوعی

پروتکل ThoughtDAG تاریخچهٔ خطی چت‌ها را با گراف‌های متنی جایگزین می‌کند تا کاربر دقیقاً تعیین کند چه اطلاعاتی به پرامپت برسد. این سازوکار با حذف شاخه‌های نامرتبط، از «آلودگی…

۲ دقیقه خواندن۴
تست جدید: هوش مصنوعی هنوز در درک بصری ضعیف است

چرا پیشرفته‌ترین مدل‌های هوش مصنوعی در مهارت‌های بصری پایه شکست می‌خورند؟

محک جدید Moonshot AI نشان می‌دهد حتی پیشرفته‌ترین مدل‌های چندوجهی در درک ابتدایی تصاویر ناتوان‌اند. هیچ مدلی نتوانست از مرز ۶۰ درصد صحت در مهارت‌های بصری پایه عبور کند، که ثابت…

۴ دقیقه خواندن۱
جایگزین‌های Claude Opus 5: انتخاب Pin 4.6 یا بهبود پرامپت شما
آموزش کاربردی

تثبیت نسخه ۴.۶ کلود اوپوس هزینه توکن‌های ورودی را ۲۳٪ کاهش می‌دهد

بسیاری از کاربران که از افت کیفیت Claude Opus 5 شکایت دارند، در واقع با تغییرات رفتاری مدل روبه‌رو هستند نه کاهش توانایی. توسعه‌دهندگان می‌توانند با تنظیم پرامپت‌ها یا تثبیت نسخه…

۲۰ دقیقه خواندن۱