پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۸۸ مقاله منتشر شده

AI

چگونه Cursor با بازخورد متنی، سیگنال یادگیری عامل‌های خود را ۲۰۰۰ برابر کرد؟

نسخه Cursor Composer 2.5 با معرفی یادگیری تقویت‌شده مبتنی بر بازخورد متنی هدفمند، مشکل «تخصیص اعتبار» در جلسات طولانی را حل کرده است. این روش با جایگزینی پاداش‌های کلی با…

۲ دقیقه خواندن۱
AI
آموزش کاربردی

چگونه Open-MM-RL توهمات ریاضی در مدل‌های چندوجهی را حذف می‌کند؟

یک خط لوله (Pipeline) جدید برای آموزش مدل‌های بینایی-زبانی معرفی شده است که به جای تکیه بر حدس‌های هوش مصنوعی، از اثبات‌های ریاضی برای پاداش‌دهی استفاده می‌کند. این روش با ترکیب…

۲ دقیقه خواندن۱
AI

مایکروسافت SkillOpt: کسب رتبه اول در ۵۲ بنچمارک عامل‌های هوش مصنوعی

چارچوب جدید SkillOpt مایکروسافت مهارت‌های عامل‌های هوش مصنوعی را به‌جای تغییر وزن‌های مدل، از طریق توصیفات متنی بهینه می‌کند. این روش در ۵۲ محیط مختلف، نتایجی برابر یا بهتر از…

۲ دقیقه خواندن۱
AI

چرا اپل برای نجات سیری به مدل ۱.۲ تریلیون پارامتری گوگل روی آورد؟

اپل برای ارتقای سیری از یک مدل سفارشی ۱.۲ تریلیون پارامتری گوگل استفاده می‌کند. این سیستم وظایف را بین پردازش محلی برای کارهای ساده و استنتاج ابری برای درخواست‌های پیچیده تقسیم…

۲ دقیقه خواندن۱
AI
آموزش کاربردی

گوگل و NYU: کاهش ۸ برابری حافظه مورد نیاز برای جستجوی برداری بدون آموزش

کتابخانه turbovec با معرفی روشی جدید برای کوانتایز کردن بردارها، مصرف حافظه در سیستم‌های RAG را ۸ برابر کاهش می‌دهد. این فناوری برخلاف روش‌های سنتی، نیازی به داده‌های آموزشی ندارد…

۲ دقیقه خواندن
AI

چرا گلوگاه عملکرد عامل‌های هوش مصنوعی مدل نیست، بلکه مهندسی هارنس است؟

شرکت Hugging Face یک چارچوب فنی برای استانداردسازی مفاهیم عامل‌های هوش مصنوعی معرفی کرد. این مدل با تفکیک مدل از لایه‌های اجرایی، دیدگاهی دقیق برای طراحی و آموزش سیستم‌های…

۲ دقیقه خواندن۱
AI

گوگل دیپ‌مایند: حل ۹ مسئله‌ی باز Erdős با هزینه‌ای کمتر از چندصد دلار

سیستم AlphaProof Nexus گوگل توانست ۹ مسئله‌ی ریاضی دشوار Erdős را با استفاده از یک حلقه‌ی تأیید رسمی حل کند. این دستاورد ثابت می‌کند که عامل‌های ساده‌ی متصل به کامپایلر می‌توانند…

۲ دقیقه خواندن۲
AI

مدل اقامتی: سازوکاری که هزینه‌های استنتاج هوش مصنوعی را دائمی می‌کند

هزینه‌های زیرساختی هوش مصنوعی از مدل‌های مصرفی به «اقامتی» تغییر می‌کنند. به دلیل تأخیر در شروع سرد، مدل‌ها باید همیشه فعال بمانند و این امر یک کف هزینه‌ای دائمی ایجاد می‌کند که…

۳ دقیقه خواندن
AI

بمب ساعتی در کدها: چرا عامل‌های هوش مصنوعی در جزئیات شکست می‌خورند؟

جورج هاتز هشدار می‌دهد که عامل‌های کدنویس تنها تقلیدکننده‌های آماری هستند و با ایجاد باگ‌های پنهان، هزینه‌های سنگینی ایجاد می‌کنند. در حالی که کارپاتی بهره‌وری ۱۰ برابری را…

۲ دقیقه خواندن۱
AI

بنچمارک CiteVQA: دقت GPT-5.4 در استناد به منابع تا ۵۹ درصد سقوط کرد

پژوهشگران با معرفی بنچمارک CiteVQA، پدیده‌ی «توهم استنادی» را شناسایی کردند؛ وضعیتی که در آن مدل‌ها پاسخ درست می‌دهند اما منبع اشتباهی را ذکر می‌کنند. نتایج نشان می‌دهد حتی…

۳ دقیقه خواندن۲