پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۷۱ مقاله منتشر شده

دو مدل زبانی بزرگ در حال رقابت زنده با کدهای GLSL در محیطی تعاملی.
آموزش کاربردی

«لاگ‌های سخت‌افزاری»؛ معیار جدید Refract برای ارزیابی مدل‌های زبانی

پلتفرم Refract با جایگزینی بنچمارک‌های انتزاعی با رندرهای زنده GPU، مدل‌های زبانی را در محیطی رقابتی برای نوشتن شیدرهای GLSL به چالش می‌کشد. در این سامانه، لاگ‌های خطای واقعی…

۴ دقیقه خواندن۱
تست جعبه‌سیاه برای ایمنی هوش مصنوعی پیشرفته ناکارآمد است
آموزش کاربردی

تحلیل ایمنی: تست‌های جعبه‌سیاه قادر به شناسایی رفتارهای پنهان مدل‌ها نیستند

ارزیابی‌های سنتی ورودی-خروجی برای مدل‌های پیشرو ناکارآمد است، زیرا این مدل‌ها می‌توانند رفتارهای مضر را در زمان تست پنهان کنند. ایمنی واقعی نیازمند گذار از مشاهده خروجی‌ها به…

۸ دقیقه خواندن۲
لوگوی UK AISI و EvalEval در کنار هم، نماد همکاری برای قابل‌تکرار کردن نتایج ارزیابی مدل‌های هوش مصنوعی

درون استراتژی AISI برای راستی‌آزمایی مدل‌های هوش مصنوعی پیشرو

مؤسسه ایمنی هوش مصنوعی بریتانیا (AISI) برای تبدیل نتایج ارزیابی مدل‌های پیشرو به حقایق علمی قابل راستی‌آزمایی، زیرساخت باز EvalEval را پذیرفت. این اقدام داده‌های سطح تراکنش را…

۴ دقیقه خواندن
نوشتن کد Rust سریع‌تر از کتابخانه‌های پیشرفته با درخواست از عامل‌ها برای بهینه‌سازی سرعت
آموزش کاربردی

عامل‌های هوش مصنوعی در برابر کتابخانه‌های انسانی؛ برتری در سرعت Rust

یک متدولوژی جدید بر پایه عامل‌های هوش مصنوعی و محک‌زنی تکرارشونده، مدل‌های زبانی را قادر ساخت کدهایی در زبان Rust بنویسند که از کتابخانه‌های پیشرفته انسانی سریع‌تر است. این رویکرد…

۲۳ دقیقه خواندن
عکس: یک عرصه بازی گوموکو با هوش مصنوعی که از طریق پروتکل MCP با هم رقابت می‌کنند
آموزش کاربردی

استدلالِ بلادرنگ در برابر نصب محلی؛ تغییر رویکرد در ارزیابی عامل‌های AI

یک محیط رقابتی جدید برای بازی گوموکو، امکان تقابل عامل‌های هوش مصنوعی را از طریق پروتکل MCP فراهم کرد. این پلتفرم با حذف نیاز به نصب نرم‌افزار محلی، استدلال مدل‌های پیشرو را تحت…

۲ دقیقه خواندن۳
پرچم‌دار مقرون‌به‌صرفه هوش مصنوعی شیائومی پیشتاز مدل‌های متن‌باز است

درون چالش‌های عرضه MiMo-V2.6؛ از راندمان هزینه تا حقوق کپی‌رایت

شیائومی سری MiMo-V2.6 را معرفی کرد که مدل پرچمدار آن در حال حاضر پیشروترین مدل با وزن‌های باز از نظر هوش است. با وجود بهره‌وری هزینه‌ای خیره‌کننده، این عرضه با اتهامات آنتروپیک…

۳ دقیقه خواندن
معرفی اشتراک امنیت تهاجمی مبتنی بر هوش مصنوعی توسط Unit 42

Palo Alto Networks: شناسایی خودکار نقاط ضعف با مدل‌های پیشرو

شرکت پالو آلتو نتورکس سرویس جدیدی را برای شناسایی و رفع خودکار نقاط ضعف سازمانی با استفاده از مدل‌های پیشرو معرفی کرد. این سیستم برای مقابله با حملات مبتنی بر هوش مصنوعی طراحی شده…

۴ دقیقه خواندن