پرش به محتوای اصلی

دسته‌بندی

آموزش کاربردی

راهنماهای گام‌به‌گام، دوره‌ها و آموزش‌های کاربردی استفاده از هوش مصنوعی — از مهندسی پرامپت تا فاین‌تیون و RAG.

۸٬۱۴۵ مقاله منتشر شده

۸۶٪ دقت در تأیید پروتکل‌های درمانی سکته مغزی با ارکستراسیون مدل‌های زبانی

۸۶٪ دقت در تأیید پروتکل‌های درمانی سکته مغزی با ارکستراسیون مدل‌های زبانی

یک چارچوب جدید هوش مصنوعی می‌تواند رعایت دستورالعمل‌های پزشکی را تنها با تحلیل متون نامساختار تأیید کند. مطالعه‌ای در بیمارستان Alessandria موفق شد بدون نیاز به دستورالعمل‌های…

۱ دقیقه خواندن۱
MedSci Skills: شناسایی ۱۰۰٪ خطاهای پزشکی با جایگزینی LLM با گیت‌های قطعی

MedSci Skills: شناسایی ۱۰۰٪ خطاهای پزشکی با جایگزینی LLM با گیت‌های قطعی

معماری جدید MedSci Skills با جایگزینی خود-ارزیابی مدل‌های زبانی با گیت‌های تأیید قطعی، توانست تمام خطاهای تزریق‌شده در متون بالینی را شناسایی کند. در حالی که مدل‌های زبانی معمولی…

۲ دقیقه خواندن
AliyunConsoleAgent: دستیابی به عملکرد مدل‌های پیشرو با ۹۲٪ هزینه کمتر

AliyunConsoleAgent: دستیابی به عملکرد مدل‌های پیشرو با ۹۲٪ هزینه کمتر

یک چارچوب آموزشی جدید با بهره‌گیری از تقطیر دانش و بهینه‌سازی GRPO، مدلی با ۳۲ میلیارد پارامتر را به سطح مدل‌های تجاری پیشرو در اتوماسیون کنسول‌های ابری رسانده است. این سیستم ضمن…

۲ دقیقه خواندن۱
رمزگشایی از «قرارداد شناختی» در SuperBrowser: عبور از بن‌بست پردازش DOM در وب

رمزگشایی از «قرارداد شناختی» در SuperBrowser: عبور از بن‌بست پردازش DOM در وب

عامل جدید SuperBrowser با دستیابی به نرخ موفقیت ۸۹.۴۷ درصدی در بنچمارک Mind2Web Hard، استانداردهای ناوبری وب را جابه‌جا کرد. این سیستم به جای پردازش جامع داده‌های صفحه، از مکانیزم…

۲ دقیقه خواندن۱
«مالیات استدلال»: کاهش ۲۸ درصدی دقت مدل‌های متوسط در خروجی‌های JSON

«مالیات استدلال»: کاهش ۲۸ درصدی دقت مدل‌های متوسط در خروجی‌های JSON

پژوهشی جدید نشان می‌دهد اجبار مدل‌های زبانی متوسط به تولید خروجی ساختاریافته (JSON)، دقت استدلالی آن‌ها را تا ۲۸ درصد کاهش می‌دهد. این پدیده که «مالیات استدلال» نامیده شده، نشان…

۲ دقیقه خواندن۱
VisShield و گذار از تاری تصاویر به حذف هدفمند داده‌های حساس در مدل‌های بینایی

VisShield و گذار از تاری تصاویر به حذف هدفمند داده‌های حساس در مدل‌های بینایی

پژوهشگران با معرفی VisShield و مجموعه‌داده‌ی OPTIC، چارچوبی برای شناسایی و ماسک‌گذاری دقیق اطلاعات خصوصی در مدل‌های بینایی-زبانی (VLMs) ارائه کردند. این رویکرد ریسک نشت داده‌های…

۱ دقیقه خواندن
چرا ترکیب زنجیره تفکر و MCTS در مهندسی ویژگی‌های جدولی بهین‌ترین بازدهی را دارد؟

چرا ترکیب زنجیره تفکر و MCTS در مهندسی ویژگی‌های جدولی بهین‌ترین بازدهی را دارد؟

چارچوب جدید LATTEArena نشان می‌دهد که ترکیب زنجیره تفکر و جستجوی درختی مونت‌کارلو، بهینه‌ترین روش برای خودکارسازی مهندسی ویژگی‌ها در داده‌های جدولی است. این مطالعه معیارهای…

۱ دقیقه خواندن
تغییر رویکرد از «دوربین» به «نقشه» در AlloSpatial؛ ارتقای ۱۸ درصدی استدلال مکانی

تغییر رویکرد از «دوربین» به «نقشه» در AlloSpatial؛ ارتقای ۱۸ درصدی استدلال مکانی

چهارچوب AlloSpatial با تبدیل دیدهای محدود به نقشه‌های جهانی، مشکل «شکنندگی مکانی» در مدل‌های چندوجهی را حل کرده است. این سیستم استدلال فضایی در مدل‌هایی مانند Qwen3-VL را تا ۱۸٪…

۱ دقیقه خواندن
ARMS: مسیریابی ۸۰۰ میلیون پارامتری که GPT-4o را در انتخاب VLM شکست داد

ARMS: مسیریابی ۸۰۰ میلیون پارامتری که GPT-4o را در انتخاب VLM شکست داد

سامانه‌ی مسیریابی ARMS با بهره‌گیری از یک مجموعه‌داده‌ی تخصصی، قادر است بهینه‌ترین مدل چندوجهی را برای هر پرس‌وجو انتخاب کند. این سیستم با وجود ابعاد بسیار کوچک‌تر، در دقت انتخاب…

۱ دقیقه خواندن
توقف ویرایش‌های تصادفی AI در پروژه‌های بزرگ با معماری Sandbox در Plandex
آموزش کاربردی

توقف ویرایش‌های تصادفی AI در پروژه‌های بزرگ با معماری Sandbox در Plandex

Plandex یک عامل هوشمند متن‌باز و مبتنی بر ترمینال است که برای مدیریت تسک‌های پیچیده کدنویسی در چندین فایل طراحی شده است. این ابزار با ذخیره تغییرات در یک محیط ایزوله پیش از اعمال…

۶ دقیقه خواندن
چرا اپلیکیشن‌های ساخته‌شده با AI در مرحله استقرار با بن‌بست مواجه می‌شوند؟
آموزش کاربردی

چرا اپلیکیشن‌های ساخته‌شده با AI در مرحله استقرار با بن‌بست مواجه می‌شوند؟

توسعه‌دهندگانی که از ابزارهایی مثل Bolt استفاده می‌کنند، اغلب با مشکل مالکیت داده و نبود سیستم بازگشت در محیط عملیاتی مواجه‌اند. Nometria با خودکارسازی انتقال این اپلیکیشن‌ها به…

۲ دقیقه خواندن۱