پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۶۳ مقاله منتشر شده

چرا هزینه LLM ما ۳۱ هزار دلار شد نه ۱۲ هزار: ۴ دام تولید که در صفحه قیمت‌گذاری نمی‌بینید
آموزش کاربردی

چهار تلهٔ عملیاتی که هزینهٔ مدل‌های زبانی را از ۱۲ به ۳۱ هزار دلار رساند

کالبدشکافی یک زیرساخت تولیدی نشان می‌دهد چگونه حلقه‌های عامل‌محور و مدل‌های استدلالی، هزینه‌های پنهانی ایجاد می‌کنند که در ماشین‌حساب‌های قیمت‌گذاری استاندارد دیده نمی‌شوند. این…

۲ دقیقه خواندن۲
نمودار معماری ترنسفورمر در مدل‌های زبانی بزرگ با بلوک‌های انکدر و دیکدر و مکانیزم توجه چندسره
آموزش کاربردی

«جایگزینی پردازش متوالی»؛ کلید درک زمینه در مدل‌های زبانی مدرن

معماری ترنسفورمر با جایگزینی پردازش متوالی با مکانیزم «خودتوجهی»، توانست تمام اجزای یک متن را به‌طور هم‌زمان تحلیل کند. این تغییر بنیادین، درک زمینه (Context) را در مدل‌های هوش…

۳ دقیقه خواندن۱
نقشه‌برداری از استدلال درونی مدل‌های هوش مصنوعی: مطالعه‌ای جدید

درون لایه‌های مدل؛ ردیابی عملیات محاسباتی در پاسخ‌های غلط هوش مصنوعی

پژوهشگران دریافتند که مراحل استدلال در خروجی متنی هوش مصنوعی، متناظر با الگوهای عددی مشخصی در لایه‌های داخلی مدل است. این یافته نشان می‌دهد منطق مدل عمیق‌تر از کلمات است و حتی در…

۳ دقیقه خواندن۱
عامل هوش مصنوعی واقعی در اودو ۱۹: بررسی کد منبع برای فهمیدن آنچه پس از نوشتن رخ می‌دهد

شکاف تأیید در Odoo 19؛ وقتی عامل‌های هوش مصنوعی موفقیتِ کاذب گزارش می‌کنند

تحلیل فنی کد Odoo 19 نشان می‌دهد عامل‌های هوش مصنوعی این سیستم، موفقیت عملیات نوشتن در پایگاه‌داده را بدون بازخوانی واقعی تأیید می‌کنند. این نقص ساختاری ریسک ایجاد داده‌های…

۶ دقیقه خواندن
حکمرانی هوش مصنوعی باید در زمان اجرا و قطعی باشد
آموزش کاربردی

پلتفرم SAFi: حذف تصمیم‌گیری LLM برای دستیابی به پیش‌بینی‌پذیری ۱۰۰ درصدی

پلتفرم SAFi با حذف قدرت تصمیم‌گیری از مدل‌های زبانی، آن‌ها را از جایگاه کنترل‌کننده به اجزای استدلالی تبدیل کرده است. این سیستم تمام اقدامات را از طریق قوانین قطعی پایتون هدایت…

۲ دقیقه خواندن
دستگاه بیومتریک: وزارت امنیت داخلی آمریکا ۴۴۰ میلیون دلار روی دوربین‌ها شرط‌بندی کرد
آموزش کاربردی

آیا سخت‌افزارهای پیشرفته می‌توانند ضعف مدل‌های شناسایی چهره را بپوشانند؟

وزارت امنیت داخلی آمریکا با تخصیص ۴۴۰ میلیون دلار برای سخت‌افزارهای بیومتریک، تأیید کرد که نقص‌های داده در سطح سنسور با نرم‌افزار قابل جبران نیستند. این چرخش راهبردی نشان می‌دهد…

۳ دقیقه خواندن۲
مقابله با سوءاستفاده از هوش مصنوعی: سپتامبر ۲۰۲۶ / آنتروپیک

درون سیستم‌های خودکار آنتروپیک برای شناسایی هدف و سرقت داده‌ها

گزارش جدید آنتروپیک فاش می‌کند که گروه‌های جاسوسی دولتی و مجرمان سایبری از مدل‌های Claude برای ساخت «کارخانه‌های اکسپلویت» استفاده می‌کنند. این سیستم‌های خودکار اکنون می‌توانند…

۱۵۲ دقیقه خواندن
مدل جدید هوش مصنوعی گوگل آینده را از داده‌های فروش، آب‌وهوا و برنامه تخفیف پیش‌بینی می‌کند

مدل TimesFM-3 گوگل پیش‌بینی فروش را با متغیرهای محیطی دقیق‌تر کرد

گوگل مدل TimesFM-3 را برای پیش‌بینی روندهای آینده با پشتیبانی از داده‌های چندمتغیره معرفی کرد. این مدل برخلاف نسخه‌های پیشین، متغیرهای خارجی مانند آب‌وهوا و تخفیف‌ها را برای حذف…

۴ دقیقه خواندن۲
مجموعه‌داده‌ها و مدل‌های تایلندی در Hugging Face که اکثر مردم هرگز پیدا نمی‌کنند
آموزش کاربردی

۴ منبع داده و مدل تایلندی در Hugging Face که توسعه‌دهندگان نادیده می‌گیرند

بسیاری از متخصصان هوش مصنوعی در تایلند به جای استفاده از منابع رایگان و باکیفیت، تنها بر چند مدل مشهور تکیه می‌کنند. این راهنما ابزارهای تخصصی برای ارزیابی، گفتگوهای چندمرحله‌ای و…

۳ دقیقه خواندن
مهندسی تمیز، اندازه‌گیری ناپایدار: شکست قابلیت اعتماد مشاهده‌گرهای جعبه‌سیاه LLM در نقاط پایانی مشترک

ناپایداری ۸ تا ۲۰ درصدی در محک‌های عامل‌های هوش مصنوعی

پژوهشی جدید نشان می‌دهد مدل‌های زبانی که به‌عنوان داور در ارزیابی عامل‌ها استفاده می‌شوند، حتی با ورودی‌های یکسان نتایج متناقضی می‌دهند. این ناپایداری که ناشی از به‌روزرسانی‌های…

۴ دقیقه خواندن۱
پنج تنظیم مهم اولاما برای اجرای جدی مدل‌های محلی
آموزش کاربردی

۵ تنظیمات کلیدی در اولاما برای افزایش سرعت استنتاج مدل‌های محلی

بسیاری از کاربران به دلیل تنظیمات پیش‌فرض غیربهینه، با کندی مدل‌های محلی مواجه می‌شوند، نه به دلیل محدودیت سخت‌افزاری. بهینه‌سازی حافظه و مکانیزم‌های توجه می‌تواند سرعت و بهره‌وری…

۴ دقیقه خواندن۳