پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۲۰ مقاله منتشر شده

نحوه ساخت عامل خودکار علم داده سازگار با T4 با DeepAnalyze-8B، اجرای کد ایزوله و تحلیل تکرارشونده
آموزش کاربردی

چطور DeepAnalyze-8B تحلیل داده‌های خودکار را به سخت‌افزار محدود می‌آورد؟

مدل DeepAnalyze-8B امکان ساخت عامل‌های تحلیل داده مستقل را فراهم می‌کند که قادر به کدنویسی، اجرا و اصلاح خطا در محیط ایزوله هستند. استفاده از کوانتش ۴ بیتی، این گردش کار را حتی بر…

۷ دقیقه خواندن
نمایش شبکه عصبی ترنسفورمر در حال تصمیم‌گیری برای حرکت بعدی در بازی دوز
آموزش کاربردی

درون ماتریس‌های توجه؛ مشاهدهٔ جریان توکن‌ها در مدل‌های زبانی

یک راهنمای تعاملی جدید با پیاده‌سازی مدل ترنسفورمر در بازی تیک-تک-تو، لایه‌های پیچیده مدل‌های زبانی را برای کاربران تجسم می‌کند. این ابزار امکان مشاهدهٔ لحظه‌ای ضرب ضرب‌های…

۱ دقیقه خواندن
تغییر فقط در توضیحات محصول، تغییر در توصیه هوش مصنوعی
آموزش کاربردی

چرا شفافیت در شرح کالا باعث اعتماد بیشتر مدل‌های زبانی می‌شود؟

یک آزمایش کنترل‌شده نشان می‌دهد که نحوه توصیف محصول، بیش از ماهیت آن، تعیین می‌کند که آیا یک مدل زبانی آن را توصیه می‌کند یا خیر. در حالی که شفافیت باعث صدور توصیه می‌شود،…

۵ دقیقه خواندن
مدل‌های جهانی مسابقه بعدی هوش مصنوعی‌اند؛ زیرساخت آن هنوز آماده نیست.

چرا شبیه‌سازهای هوش مصنوعی در زیرساخت‌های نرم‌افزاری متوقف شده‌اند؟

آزمایشگاه‌های هوش مصنوعی در حال تغییر رویکرد از پیش‌بینی توکن بعدی به پیش‌بینی وضعیت‌های محیطی هستند. در حالی که این مدل‌ها در رباتیک پیشرفت کرده‌اند، penerapan این شبیه‌سازها در…

۴ دقیقه خواندن
چرا عامل‌های هوش مصنوعی در وظایف چندمرحله‌ای شکست می‌خورند و چگونه خطای خاموش را شناسایی کنیم
آموزش کاربردی

جایگزینی تاییدیه ابزار با داده‌های مرجع؛ راهکار مقابله با شکست‌های خاموش در

عامل‌های هوش مصنوعی اغلب بر اساس پاسخ‌های ابزارها گزارش موفقیت می‌دهند، در حالی که داده‌ها در واقع در پایگاه‌داده ذخیره نشده‌اند. برای رفع این «شکست‌های خاموش»، توسعه‌دهندگان باید…

۷ دقیقه خواندن
معماری یک معلم خصوصی واقعی‌زمان: آموزش کودک در کمتر از ۱۰۰۰ میلی‌ثانیه
آموزش کاربردی

معماری جدید Ello تأخیر پاسخ‌دهی هوش مصنوعی در آموزش کودکان را به زیر یک ثانیه

شرکت Ello با جداسازی فرآیند تولید پاسخ از اجرا و استفاده از برنامه‌ریزی ناهمگام، مشکل تأخیر در عامل‌های هوش مصنوعی را برای کودکان ۴ تا ۹ سال حل کرد. این رویکرد باعث می‌شود نرخ…

۹ دقیقه خواندن
نمونه‌ای کوچک برای بررسی هزینه‌محور باگ‌ها
آموزش کاربردی

«شکاف خوش‌بینی»؛ توهم موفقیت در عیب‌یابی AI بر اساس متادیتا

یک نمونه اولیه پایتونی با معرفی سیاست‌های «هزینه-آگاه»، استراتژی جمع‌آوری شواهد در عیب‌یابی کد را بازتعریف می‌کند. این پروژه یک «شکاف خوش‌بینی» خطرناک را افشا کرد: شواهد مبتنی بر…

۷ دقیقه خواندن