پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۹۳۸ مقاله منتشر شده

نمودار توجه در مدل زبانی بزرگ، نمایش بصری الگوهای توجه بین کلمات در جمله.
آموزش کاربردی

تجسم لایه‌های توجه؛ رمزگشایی از مکانیزم کپی-پیست در مدل‌های زبانی

یک ابزار بصری جدید نشان می‌دهد که مدل‌های زبانی برای کپی کردن دقیق متون، به جای تکیه بر احتمال، مستقیماً روی توکن‌های منبع «قفل» می‌کنند. این پروژه ثابت می‌کند که دقت بالای هوش…

۳ دقیقه خواندن۲
تست یک هفته‌ای جستجوی شغلی با هوش مصنوعی: نتیجه صادقانه
آموزش کاربردی

ابزار متن‌باز جدید: ۶۷٪ دقت در استخراج و رتبه‌بندی فرصت‌های شغلی

یک ابزار متن‌باز جدید با معماری چندعاملی، فرآیند استخراج آگهی‌های شغلی و رتبه‌بندی آن‌ها را بر اساس رزومه کاربر خودکار می‌کند. این ابزار با اولویت دادن به اجرای محلی، حریم خصوصی…

۵ دقیقه خواندن۳
پالانتیر از نبیوس برای زیرساخت هوش مصنوعی مستقل در محیط خود استفاده می‌کند

«شریک ترجیحی برای هوش مصنوعی حاکمیتی»؛ جایگاه جدید Nebius در پالانتیر

پالانتیر با همکاری Nebius، امکان اجرای مدل‌های وزن‌باز را در محیط امن سازمانی فراهم کرد. این اقدام به شرکت‌ها اجازه می‌دهد بدون انتقال داده‌ها به ابرهای عمومی، از قدرت محاسباتی…

۴ دقیقه خواندن
۳۵ نوآور زیر ۳۵ سال امسال: دانشمندان و کارآفرینانی که آینده فناوری را شکل می‌دهند.

«تغییر استراتژی به سمت سخت‌افزار»؛ گام جدید Mistral در اروپا

آزمایشگاه هوش مصنوعی Mistral با جذب رکوردشکن‌ترین سرمایه در تاریخ فناوری اروپا، استراتژی خود را به سمت ساخت مراکز داده و زیرساخت‌های سخت‌افزاری تغییر داد. این شرکت در حالی به…

۴ دقیقه خواندن
بودجه ابزار هوش مصنوعی به بودجه زیرساخت تبدیل شد

زیرساخت‌های درون‌سازمانی در برابر هزینه‌های متغیر SaaS در Nutanix

شرکت Nutanix بودجه ابزارهای کدنویسی خود را از اشتراک‌های SaaS به یک خوشه GPU درون‌سازمانی ۲۰ میلیون دلاری تغییر داد. این اقدام نشان‌دهنده شکافی در حاکمیت شرکتی است که در آن…

۸ دقیقه خواندن۲
ابزار تست برای عامل‌های هوش مصنوعی ساختم — آسیب‌پذیری تزریق پرامپت در مدل محلی را کشف کرد.
آموزش کاربردی

آیا مدل‌های بهینه برای عامل‌های هوش مصنوعی در برابر تزریق پرامپت آسیب‌پذیرند؟

ابزار متن‌باز Agenci توانست با یک حمله تزریق پرامپت، مدل محلی Phi-4-mini را مجبور به نادیده گرفتن دستورات سیستمی کند. این یافته نشان می‌دهد مدل‌های کوچک و بهینه برای عامل‌های هوش…

۱ دقیقه خواندن۱
Qwen3.8-27B روی ۲ کارت RTX 3090: اولین مدل محلی که واقعاً بهش اعتماد دارم
آموزش کاربردی

«مدیریت گردش‌کارهای پیچیده»؛ قابلیت جدید مدل‌های محلی روی سخت‌افزار مصرفی

استقرار عملیاتی مدل Qwen3.8-27B روی دو GPU مدل RTX 3090 نشان می‌دهد که مدل‌های زبانی محلی اکنون قادر به مدیریت گردش‌کارهای پیچیده حرفه‌ای هستند. این پیکربندی با اولویت دادن به…

۳ دقیقه خواندن۱
شرکت‌های Alibaba Cloud و Cambricon به بنیاد PyTorch پیوستند و Ant Group عضو طلایی شد.

«استقلال از سازنده»؛ هدف علی‌بابا و کمبریکون از پیوستن به PyTorch

شرکت‌های علی‌بابا کلاود، کمبریکون و آنت گروپ با عضویت در بنیاد PyTorch به دنبال کاهش وابستگی به انویدیا و بهینه‌سازی مدل‌ها روی تراشه‌های متنوع هستند. این اقدام گامی استراتژیک…

۴ دقیقه خواندن