
درون چالشهای عرضه MiMo-V2.6؛ از راندمان هزینه تا حقوق کپیرایت
شیائومی سری MiMo-V2.6 را معرفی کرد که مدل پرچمدار آن در حال حاضر پیشروترین مدل با وزنهای باز از نظر هوش است. با وجود بهرهوری هزینهای خیرهکننده، این عرضه با اتهامات آنتروپیک…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۰۱ مقاله منتشر شده

شیائومی سری MiMo-V2.6 را معرفی کرد که مدل پرچمدار آن در حال حاضر پیشروترین مدل با وزنهای باز از نظر هوش است. با وجود بهرهوری هزینهای خیرهکننده، این عرضه با اتهامات آنتروپیک…

شرکت پالو آلتو نتورکس سرویس جدیدی را برای شناسایی و رفع خودکار نقاط ضعف سازمانی با استفاده از مدلهای پیشرو معرفی کرد. این سیستم برای مقابله با حملات مبتنی بر هوش مصنوعی طراحی شده…

اتکای بیش از حد به هوش مصنوعی در برنامهنویسی، شهود انسانی برای حفظ معماریهای پیچیده نرمافزاری را از بین میبرد. به دلیل نبود معیارهای بلندمدت برای پایداری، پروژههای «حسمحور»…

آزمایشگاههای پیشرو در AI از حلقههای خودبهبودی برای تولید چندین پاسخ، امتیازدهی و بازآموزی مدلها بر اساس بهترین نتایج استفاده میکنند. این خط لوله صنعتی، سازوکار اصلی تبدیل…

معیارهای سنتی «تعداد درخواست در دقیقه» برای مدلهای زبانی بزرگ ناکارآمد هستند زیرا تفاوت شدید هزینه توکنها را نادیده میگیرند. جایگزینی این مدل با سیستم اعتبار توکنمحور، از اثر…

مدلهای زبانی کوچک (SLM) با کاهش تأخیر و هزینهها، در وظایف تخصصی عملکردی بهتر از مدلهای غولپیکر دارند. شرکتها اکنون بهجای اجارهی APIهای گرانقیمت، با تنظیم دقیق مدلهای…

پژوهشگران سیسکو نوع جدیدی از بدافزارهای خودمختار را کشف کردهاند که برای تصمیمگیری درباره گامهای بعدی، از چندین مدل زبانی بزرگ بهطور همزمان استفاده میکند. این تغییر به سمت…

آکادمی علوم اتریش مدل Apollo را معرفی کرد؛ نخستین مدل زبانی تخصصی برای زبان یونانی باستان که با پیشبینی آماری، بخشهای تخریبشده پاپیروسهای قدیمی را بازسازی میکند.

شرکت آنتروپیک با تأسیس یک آزمایشگاه فیزیکی در سانفرانسیسکو، توسعه داروهای مبتنی بر هوش مصنوعی را از شبیهسازی به آزمایشهای واقعی منتقل میکند. در این مرکز، مدل Claude بهطور…

کاهش زمان پاسخدهی هوش مصنوعی تنها به سختافزار سریعتر وابسته نیست، بلکه نیازمند بهینهسازی پرامپتها و موازیسازی درخواستهاست. این استراتژیها با تمرکز بر «زمان تا نخستین…

ارزیابی جدیدی از قابلیتهای Claude Code نشان میدهد ابزارهایی که متدولوژیهای سختگیرانه مانند TDD را تحمیل میکنند، بسیار مؤثرتر از ابزارهای صرفاً کدنویس هستند. این محدودیتها از…

مقیاسدهی خودکار بر اساس CPU برای مدلهای زبانی شکست میخورد زیرا گلوگاه واقعی در پهنایباند حافظه و KV-cache است. توسعهدهندگان با جایگزینی معیارهای سنتی با «عمق صف»، میتوانند…