پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۴۴ مقاله منتشر شده

دلتافین: اجرای استریمد مدل کیمی K3 (۲.۸ تریلیون پارامتر MoE) از روی SSD روی پردازنده‌های اپل سیلیکون با فناوری ذخیره‌سازی ARG
آموزش کاربردی

پروژه Deltafin مدل ۲.۸ تریلیون پارامتری Kimi K3 را روی لپ‌تاپ‌های اپل اجرا کرد

پروژه Deltafin با استفاده از تکنیک استریم کردن وزن‌ها از حافظه SSD، اجرای کامل مدل ۲.۸ تریلیون پارامتری Kimi K3 را روی سخت‌افزارهای مصرف‌کننده اپل ممکن کرد. این رویکرد به‌جای…

۸ دقیقه خواندن۳
لوگوی مروری ۲.۵ با عنوان «آغاز»، نمادی از شروع دوره جدیدی در توسعه هوش مصنوعی.

مدل Mercury 2.5 هوش مصنوعی را ۴۰٪ ارتقا داد اما تأخیر را ثابت نگه داشت

شرکت Inception مدل Mercury 2.5 را به‌عنوان بزرگ‌ترین مدل زبانی مبتنی بر انتشار معرفی کرد که ۴۰٪ هوشمندتر از نسل قبل است. این مدل با توان عملیاتی ۱۱۰۷ توکن در ثانیه، برای کاربردهای…

۴ دقیقه خواندن۳
تبدیل ۲۰۰۰ گفتگوی مشتری به داده قابل جستجو در چند ساعت
آموزش کاربردی

«تفکیک ارزیابی‌های گران‌قیمت»؛ راهکار جدید برای تحلیل داده‌های حجیم

یک معماری جدید با تفکیک ارزیابی‌های گران‌قیمت مدل زبانی از پرس‌وجوهای سریع، تحلیل هزاران مکالمه مشتری را ممکن کرده است. این سیستم با نرمال‌سازی داده‌ها پیش از استنتاج، همسویی…

۳ دقیقه خواندن۱
مدل ۳ میلیارد پارامتری من یک میان‌بر پیدا کرد. بستن آن سه اصلاح لازم داشت.
آموزش کاربردی

چرا مدل‌های زبانی به‌جای یادگیری الگوها، به دنبال پاداش سریع هستند؟

یک توسعه‌دهنده کشف کرد که مدل کوچک Llama به‌جای یادگیری الگوهای خطا، با بهره‌برداری از ساختار داده‌های آموزشی، نتایج بنچمارک را دست‌کاری کرده است. این یافته نشان می‌دهد مدل‌ها در…

۹ دقیقه خواندن۱
هوش مصنوعی من همه چیز مهم را به خاطر سپرد، اما آنچه دیشب کردم را فراموش کرد.
آموزش کاربردی

گراف‌های عصبی در برابر جست‌وجوی برداری در اولویت‌بندی دانش AI

سامانهٔ حافظهٔ متن‌باز Mycelium با جداسازی «مرکزیت» از «تازگی»، مشکل فراموشی زمینه‌های فوری در مدل‌های هوش مصنوعی را حل کرده است. این سیستم به‌جای تکیه بر جست‌وجوی برداری ساده، از…

۶ دقیقه خواندن۲
نکات پرامپت‌نویسی GPT-6 آسترا: فهرست کلمات ممنوعه و راهنمای بهینه‌سازی پرسش‌ها

آیا ابزارهای نظارتی می‌توانند با سرعتِ رشد هوش بازگشتی همگام شوند؟

اوپن‌ای‌آی به هدف ایجاد «کارآموز پژوهشی خودکار» دست یافت که اکنون بیش از سه برابر نیروی انسانی کار می‌کند. با این حال، مدیران شرکت هشدار می‌دهند که ابزارهای نظارتی از سرعت رشد این…

۵ دقیقه خواندن۱
نمودار توجه در مدل زبانی بزرگ، نمایش بصری الگوهای توجه بین کلمات در جمله.
آموزش کاربردی

تجسم لایه‌های توجه؛ رمزگشایی از مکانیزم کپی-پیست در مدل‌های زبانی

یک ابزار بصری جدید نشان می‌دهد که مدل‌های زبانی برای کپی کردن دقیق متون، به جای تکیه بر احتمال، مستقیماً روی توکن‌های منبع «قفل» می‌کنند. این پروژه ثابت می‌کند که دقت بالای هوش…

۳ دقیقه خواندن۲
مسئله هزاره‌ای معادلات ناویر-استوکس: بررسی وجود و همواری راه‌حل‌ها

سامانهٔ چندعاملی OpenAI معمای ۹۰ سالهٔ معادلات ناویر-استوکس را حل کرد

یک سیستم داخلی در OpenAI با اثبات ریاضی نشان داد که حرکت سیالات سه‌بعدی می‌تواند در زمان محدود به تکینگی برسد. این دستاورد که یکی از هفت مسئلهٔ جایزهٔ هزاره است، جهشی عظیم در…

۷ دقیقه خواندن۲
خط لوله RAG شما احتمالاً پیش از بازیابی دچار مشکل است
آموزش کاربردی

لایهٔ ورود داده؛ گلوگاه پنهانی که باعث شکست سیستم‌های RAG می‌شود

بسیاری از شکست‌های سیستم‌های تولید بازیابی‌افزا (RAG) نه در تنظیمات بازیابی، بلکه در لایهٔ ورود داده ریشه دارند. اصلاح اندازه تکه‌ها یا پرامپت‌ها بی‌فایده است اگر داده‌های خام در…

۴ دقیقه خواندن۱
آسیب‌پذیری‌ها را پیدا کرد. بیشترشان اصلاً وجود نداشتند.
آموزش کاربردی

محدودیت‌های مدل‌های زبانی در ممیزی خودکار کد و راهکار جایگزین

استفاده از مدل‌های زبانی برای یافتن آسیب‌پذیری در کدهای حجیم به‌دلیل تکیه بر الگوهای آماری به‌جای استدلال منطقی، منجر به نتایج متقاعدکننده اما نادرست می‌شود. تنها روش قابل‌اعتماد،…

۲ دقیقه خواندن۲