پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۲٬۰۴۰ مقاله منتشر شده

AI
آموزش کاربردی

بایت‌دنس: مدل ۳ میلیارد پارامتری Lance با امتیاز ۸۵.۱۱ در بنچمارک VBench

بایت‌دنس مدل Lance را معرفی کرد؛ یک مدل ۳ میلیارد پارامتری که تولید، ویرایش و درک تصویر و ویدیو را در یک چارچوب واحد جمع می‌کند. این مدل با بهره‌وری بالا، در بنچمارک‌های کلیدی…

۲ دقیقه خواندن۱
AI

توقف زودهنگام آموزش: راهکاری برای حذف ۷۱ درصدی رفتارهای مخرب در مدل‌های زبانی

پژوهشی از دانشگاه عبری اورشلیم نشان می‌دهد رفتارهای «سرکشانه» در مدل‌های هوش مصنوعی، بیش از آنکه به داده‌ها مربوط باشد، نتیجه‌ی آموزش بیش از حد (Overtraining) است. با توقف…

۳ دقیقه خواندن۳
AI
آموزش کاربردی

سازوکار NVIDIA AI-Q برای تفکیک خط لوله‌ی پژوهش از عامل‌های هوشمند

انویدیا با معرفی AI-Q، طرحی بازمتن برای انتقال وظایف پیچیده‌ی پژوهشی از عامل‌هایی مثل Claude Code به سرورهای اختصاصی ارائه داد. این ابزار اجازه می‌دهد داده‌های حساس سازمانی بدون…

۲ دقیقه خواندن
AI

Stability AI: تولید موسیقی ۶ دقیقه‌ای با وزن‌های باز و داده‌های قانونی

شرکت Stability AI مدل Stable Audio 3.0 را معرفی کرد که تولید موسیقی تا ۶ دقیقه را ممکن می‌کند. این مدل‌ها با داده‌های قانونی آموزش دیده‌اند و نسخه‌های وزن‌باز آن‌ها برای استفاده…

۲ دقیقه خواندن
AI

گزارش SWE-bench: نرخ موفقیت Claude Code در حل مشکلات گیت‌هاب به ۸۷.۶٪ رسید

عامل‌های کدنویسی به نقطه عطف استقلال رسیده‌اند و Claude Code اکنون اکثریت مشکلات واقعی گیت‌هاب را حل می‌کند. هم‌زمان، صنعت به سمت عامل‌های «ماندگار در ابر» و مدل‌های یکپارچه برای…

۲ دقیقه خواندن۱
AI
آموزش کاربردی

درون معماری جدید گوگل برای اجرای عامل‌های هوشمند و خصوصی در اندروید

گوگل با افزودن پشتیبانی از پروتکل MCP به اپلیکیشن AI Edge Gallery، امکان تعامل مدل‌های محلی با ابزارهای خارجی را فراهم کرد. این ساختار اجازه می‌دهد استدلال و پرس‌وجوهای خام در…

۲ دقیقه خواندن۱
گزارش Forge: مدل‌های ۸ میلیارد پارامتری با دقت ۸۶.۵٪ در وظایف چندمرحله‌ای
آموزش کاربردی

گزارش Forge: مدل‌های ۸ میلیارد پارامتری با دقت ۸۶.۵٪ در وظایف چندمرحله‌ای

Forge یک لایه پایداری جدید است که مدل‌های زبانی کوچک را قادر می‌سازد تا وظایف پیچیده را با دقت بالا اجرا کنند. این ابزار اجازه می‌دهد مدل‌های ۸ میلیاردی در گردش‌های کاری عامل‌محور…

۲ دقیقه خواندن۱
چگونه OlmoEarth v1.1 با توکن‌سازی متراکم، هزینه پردازش ماهواره‌ای را یک‌سوم کرد؟

چگونه OlmoEarth v1.1 با توکن‌سازی متراکم، هزینه پردازش ماهواره‌ای را یک‌سوم کرد؟

مدل OlmoEarth v1.1 هزینه محاسباتی پردازش تصاویر ماهواره‌ای را تا ۳ برابر کاهش داده است. این بهینه‌سازی از طریق ادغام رزولوشن‌های مختلف در یک توکن واحد محقق شده و دسترسی به نظارت…

۲ دقیقه خواندن۳