
مدل DeepSeek V4 Flash هزینه API را برای توسعهدهندهها ۹۰٪ کاهش داد
تستهای میدانی نشان میدهد مدلهای چینی DeepSeek و Qwen عملکردی در سطح GPT-4o دارند اما با قیمتی بسیار کمتر. توسعهدهندهها با مسیریابی هوشمند وظایف بین مدلهای مختلف، هزینههای…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۸۷ مقاله منتشر شده

تستهای میدانی نشان میدهد مدلهای چینی DeepSeek و Qwen عملکردی در سطح GPT-4o دارند اما با قیمتی بسیار کمتر. توسعهدهندهها با مسیریابی هوشمند وظایف بین مدلهای مختلف، هزینههای…

استارتاپ Atomscale با استفاده از یک سلسلهمراتب مدلهای هوش مصنوعی مبتنی بر فیزیک، گلوگاه انتقال مواد از آزمایشگاه به تولید صنعتی را برطرف کرده است. این سامانه در تحلیل دادههای…

کتابخانهی wyrm-math با استفاده از قوانین بازنویسی، محیطی میسازد که در آن عملیات ریاضی غیرقانونی بهصورت ساختاری غیرممکن است. این ابزار مخصوص توسعهدهندگانی است که میخواهند…

مدل DeepAnalyze-8B امکان ساخت عاملهای تحلیل داده مستقل را فراهم میکند که قادر به کدنویسی، اجرا و اصلاح خطا در محیط ایزوله هستند. استفاده از کوانتش ۴ بیتی، این گردش کار را حتی بر…

ارزیابی پنج مدل زبانی بزرگ نشان میدهد مدل M3 با دقتی بالاتر از Claude Opus و هزینهای بهمراتب کمتر، بهینهترین گزینه برای پایگاههای دانش مالی است. این یافته ثابت میکند برای…

یک راهنمای تعاملی جدید با پیادهسازی مدل ترنسفورمر در بازی تیک-تک-تو، لایههای پیچیده مدلهای زبانی را برای کاربران تجسم میکند. این ابزار امکان مشاهدهٔ لحظهای ضرب ضربهای…

بررسی جامع سه ابزار مسلط بر کدنویسی نشان میدهد که توسعهدهندگان از جستوجوی یک ابزار «کامل» دست کشیده و به سمت استکهای ترکیبی حرکت کردهاند. در این بازار، Claude Code برای…

نسخه جدید LibreFang دسترسی عاملهای هوش مصنوعی به چرخه تفکر مدلهای o1 را فراهم کرد. این بهروزرسانی با بهینهسازی ادغام در Slack و کاهش نویز خروجی، تجربه توسعهدهندگان را بهبود…

یک آزمایش کنترلشده نشان میدهد که نحوه توصیف محصول، بیش از ماهیت آن، تعیین میکند که آیا یک مدل زبانی آن را توصیه میکند یا خیر. در حالی که شفافیت باعث صدور توصیه میشود،…

آزمایشگاههای هوش مصنوعی در حال تغییر رویکرد از پیشبینی توکن بعدی به پیشبینی وضعیتهای محیطی هستند. در حالی که این مدلها در رباتیک پیشرفت کردهاند، penerapan این شبیهسازها در…

عاملهای هوش مصنوعی اغلب بر اساس پاسخهای ابزارها گزارش موفقیت میدهند، در حالی که دادهها در واقع در پایگاهداده ذخیره نشدهاند. برای رفع این «شکستهای خاموش»، توسعهدهندگان باید…

شرکت Ello با جداسازی فرآیند تولید پاسخ از اجرا و استفاده از برنامهریزی ناهمگام، مشکل تأخیر در عاملهای هوش مصنوعی را برای کودکان ۴ تا ۹ سال حل کرد. این رویکرد باعث میشود نرخ…