پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۸۷ مقاله منتشر شده

استقرار مدل‌های LLM روی پلتفرم‌های ابری با مقیاس‌پذیری خودکار: بهترین شیوه‌ها
آموزش کاربردی

«گلوگاه پهنای‌باند حافظه»؛ دلیل شکست مقیاس‌دهی سنتی در مدل‌های زبانی

مقیاس‌دهی خودکار بر اساس CPU برای مدل‌های زبانی شکست می‌خورد زیرا گلوگاه واقعی در پهنای‌باند حافظه و KV-cache است. توسعه‌دهندگان با جایگزینی معیارهای سنتی با «عمق صف»، می‌توانند…

۳ دقیقه خواندن۳
نسخه ۰.۱ گلاس‌هاوس منتشر شد: معیار سنجش حافظه برای سیستم‌های هوش مصنوعی
آموزش کاربردی

«فراتر از بازیابی ساده»؛ رویکرد جدید Glasshouse برای سنجش حافظه AI

محک جدید Glasshouse v0.1 با تمرکز بر حافظه بلندمدت، مدل‌های هوش مصنوعی را به‌جای بازیابی ساده، بر اساس صداقت در مواجهه با داده‌های متناقض می‌سنجد. این ابزار توهمات با اعتمادبه‌نفس…

۲ دقیقه خواندن۳
تصویری تبلیغاتی از Seedance 3 با پس‌زمینه‌ای آبی و نارنجی و متن «به زودی می‌آید»
سرگرمی و خلاقیت

نقشه راه Seedance 3: اولویت بایت‌دنس با قابلیت اطمینان در تولید ویدیو است

بایت‌دنس در نسل سوم مدل Seedance از نمایش‌های بصری خیره‌کننده به سمت ابزارهای تولیدی قابل‌اعتماد حرکت می‌کند. هدف این مدل حل چالش‌های فیزیک، ثبات شخصیت‌ها و ویرایش‌های موضعی در…

۱۲ دقیقه خواندن۲
حلقه‌های خودکار پژوهش SoL-Pi انویدیا: کاهش ۴۹٪ مصرف توکن عامل کدنویسی

انویدیا ترافیک توکن‌های عامل‌های کدنویسی را تا ۴۹٪ کاهش داد

پژوهشگران انویدیا با معرفی SoL-Pi، لایه‌ی مدیریت ابزارها در عامل‌های کدنویسی را بهینه کردند. این سیستم بدون افت عملکرد محسوس، هزینه‌های API را ۳۳٪ و مصرف توکن را تا ۴۹٪ کاهش…

۵ دقیقه خواندن۳
علی‌بابا مدل هوش مصنوعی با ۵ تا ۱۰ تریلیون پارامتر توسعه می‌دهد

«هدف رسیدن به ASI»؛ استراتژی جدید علی‌بابا برای توسعه مدل‌ها

علی‌بابا با هدف رسیدن به ابرهوش مصنوعی (ASI)، در حال توسعه مدلی با ۵ تا ۱۰ تریلیون پارامتر است. این استراتژی شامل ادغام تراشه‌های اختصاصی، زیرساخت ابری ۲۰ گیگاواتی و مکانیزم…

۴ دقیقه خواندن۱
پرچم‌دار جدید شیائومی با امتیاز ۴۶ در صدر جدول مدل‌های متن‌باز قرار گرفت

مدل‌های وزن‌باز در برابر سیستم‌های بسته؛ برتری جدید شیائومی در شاخص هوش

شیائومی سری MiMo-V2.6 را با یک مدل پرچم‌دار ۱.۰۲ تریلیون پارامتری منتشر کرد که در حال حاضر رتبه اول جدول مدل‌های وزن‌باز Artificial Analysis را در اختیار دارد. این مدل با…

۵ دقیقه خواندن۱
عامل صوتی در حال تأیید رزرو میز رستوران، اما در واقع رزرو انجام نشده است.
آموزش کاربردی

پروژه Oathra با جداسازی لایه تأیید، توهم موفقیت در عامل‌های صوتی را حذف کرد

سازنده Oathra فاش کرد که عامل‌های صوتی هوش مصنوعی اغلب پاسخ‌های مبهم را به‌اشتباه به‌عنوان رزرو موفق ثبت می‌کنند. این پروژه برای جلوگیری از «تکمیل کاذب»، یک لایه اعتبارسنجی مجزا…

۵ دقیقه خواندن
هر دروازه‌ای رد شد. شماره همچنان اشتباه بود.

توهم تیک سبز؛ چرا سیستم‌های اعتبارسنجی خودکار هوش مصنوعی شکست می‌خورند؟

بررسی یک مورد شکست عملی نشان می‌دهد که ابزارهای اعتبارسنجی هوش مصنوعی اغلب به جای حقیقت، تنها «سازگاری» داده‌ها را می‌سنجند. این وضعیت باعث می‌شود اطلاعات غلط اما یکدست، با…

۸ دقیقه خواندن۱