پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۷۳ مقاله منتشر شده

تغییر رویکرد از «دوربین» به «نقشه» در AlloSpatial؛ ارتقای ۱۸ درصدی استدلال مکانی

تغییر رویکرد از «دوربین» به «نقشه» در AlloSpatial؛ ارتقای ۱۸ درصدی استدلال مکانی

چهارچوب AlloSpatial با تبدیل دیدهای محدود به نقشه‌های جهانی، مشکل «شکنندگی مکانی» در مدل‌های چندوجهی را حل کرده است. این سیستم استدلال فضایی در مدل‌هایی مانند Qwen3-VL را تا ۱۸٪…

۱ دقیقه خواندن
کاهش نرخ توهم در تشخیص‌های پزشکی به ۳.۳٪ با معماری عامل‌محور Baichuan-M4

کاهش نرخ توهم در تشخیص‌های پزشکی به ۳.۳٪ با معماری عامل‌محور Baichuan-M4

سیستم Baichuan-M4 رویکرد هوش مصنوعی در پزشکی را از پاسخ‌های تک‌مرحله‌ای به «مراقبت مستمر» تغییر می‌دهد. این سامانه با بهره‌گیری از معماری عامل‌محور (Agentic) و آموزش تخصصی RL، نرخ…

۱ دقیقه خواندن۱
RTL-BenchLS: نرخ موفقیت مدل‌های زبانی در رفع خطاهای سخت‌افزاری تنها ۱۲٪ است

RTL-BenchLS: نرخ موفقیت مدل‌های زبانی در رفع خطاهای سخت‌افزاری تنها ۱۲٪ است

پژوهشگران با معرفی بنچمارک RTL-BenchLS نشان دادند که حتی پیشرفته‌ترین مدل‌های زبانی در طراحی سخت‌افزارهای پیچیده شکست می‌خورند. این نتایج حاکی از آن است که توانایی مدل‌ها در…

۲ دقیقه خواندن۱
DiScO: ارتقای استدلال ریاضی در مدل‌های زبانی از طریق متنوع‌سازی طرحواره‌های تفکر

DiScO: ارتقای استدلال ریاضی در مدل‌های زبانی از طریق متنوع‌سازی طرحواره‌های تفکر

چارچوب جدیدی به نام DiScO با متنوع کردن «طرحواره‌های تفکر»، توانایی مدل‌های استدلالی در حل مسائل پیچیده ریاضی را افزایش داده است. این روش با استفاده از یادگیری تقویت‌شده، مدل را…

۱ دقیقه خواندن۱
ARMS: مسیریابی ۸۰۰ میلیون پارامتری که GPT-4o را در انتخاب VLM شکست داد

ARMS: مسیریابی ۸۰۰ میلیون پارامتری که GPT-4o را در انتخاب VLM شکست داد

سامانه‌ی مسیریابی ARMS با بهره‌گیری از یک مجموعه‌داده‌ی تخصصی، قادر است بهینه‌ترین مدل چندوجهی را برای هر پرس‌وجو انتخاب کند. این سیستم با وجود ابعاد بسیار کوچک‌تر، در دقت انتخاب…

۱ دقیقه خواندن
OrderPlace: کاهش ۳۴ درصدی طول سیم‌کشی تراشه با توالی‌های بهینه شده توسط LLM

OrderPlace: کاهش ۳۴ درصدی طول سیم‌کشی تراشه با توالی‌های بهینه شده توسط LLM

چارچوب جدیدی به نام OrderPlace با استفاده از تکامل مدل‌های زبانی بزرگ، توالی قرارگیری ماکروها در طراحی تراشه را بهینه می‌کند. این رویکرد با جایگزینی قوانین ایستا با سیاست‌های…

۱ دقیقه خواندن
کاهش ۱۲.۴ درصدی خطای پیش‌بینی در صنعت با معماری Mixture-of-Experts مدل FAME

کاهش ۱۲.۴ درصدی خطای پیش‌بینی در صنعت با معماری Mixture-of-Experts مدل FAME

معماری جدید FAME با استفاده از «اثر انگشت پیش‌بینی‌پذیری»، نرخ خطای پیش‌بینی سری‌های زمانی صنعتی را ۱۲.۴٪ کاهش داده است. این مدل با توزیع هوشمند داده‌ها میان متخصصان مختلف، دقت را…

۲ دقیقه خواندن
توقف ویرایش‌های تصادفی AI در پروژه‌های بزرگ با معماری Sandbox در Plandex
آموزش کاربردی

توقف ویرایش‌های تصادفی AI در پروژه‌های بزرگ با معماری Sandbox در Plandex

Plandex یک عامل هوشمند متن‌باز و مبتنی بر ترمینال است که برای مدیریت تسک‌های پیچیده کدنویسی در چندین فایل طراحی شده است. این ابزار با ذخیره تغییرات در یک محیط ایزوله پیش از اعمال…

۶ دقیقه خواندن
آیا با یک ربات صحبت می‌کنید؟ تصویری از چالش تشخیص هویت هوش مصنوعی
آموزش کاربردی

RealityTest: یک خط دستور در پرامپت سیستم، شفافیت مدل‌ها را به زیر ۵٪ رساند

پژوهش جدید RealityTest نشان می‌دهد که مدل‌های هوش مصنوعی به‌سادگی در پنهان کردن هویت خود تحریک می‌شوند. یک دستور ساده در پرامپت سیستم می‌تواند شفافیت مدل را تقریباً از بین ببرد و…

۴ دقیقه خواندن
چارچوب مهندسی ارزیابی برای افزایش قابلیت اطمینان مدل‌های زبانی بزرگ
آموزش کاربردی

چرا تکیه بر «حس» در توسعه‌ی هوش مصنوعی، بزرگ‌ترین ریسک عملیاتی شماست؟

مهندسی ارزیابی چارچوبی سیستماتیک برای تبدیل مدل‌های زبانی از نمونه‌های اولیه پیش‌بینی‌ناپذیر به سیستم‌های قابل اتکا در محیط تولید است. این رویکرد تست‌های مبتنی بر «حس و برداشت» را…

۱ دقیقه خواندن
ربات شیائومی MiMo با شعار اکتشاف و عشق

شیائومی: دستیابی به سرعت ۱۰۰۰ توکن در ثانیه برای مدل ۱ تریلیون پارامتری

شیائومی مدل MiMo-V2.5-Pro-UltraSpeed را معرفی کرد که روی GPUهای معمولی به سرعت ۱۰۰۰ توکن در ثانیه می‌رسد. این پیشرفت با ترکیب کوانتایزاسیون FP4 و رمزگشایی موازی-گمانه، گلوگاه‌های…

۷ دقیقه خواندن
چگونه ArcOS با کدنویسی قطعی، مانع از محو شدن شخصیت عامل‌های هوش مصنوعی می‌شود؟
آموزش کاربردی

چگونه ArcOS با کدنویسی قطعی، مانع از محو شدن شخصیت عامل‌های هوش مصنوعی می‌شود؟

هایجون ون، بنیان‌گذار Light Ark Technologies، با معرفی ArcOS راهکاری برای توقف «رانش شخصیت» (Persona Drift) ارائه داد. این سیستم پرامپت‌های شکننده را با ۷۵ بلوک تصمیم‌گیرندهٔ قطعی…

۲ دقیقه خواندن