پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۲٬۰۵۷ مقاله منتشر شده

چارچوب یادگیری تقویتی خودبهبوددهنده Prime Agent متن‌باز شد.
آموزش کاربردی

Prime Agent با محیط پایتون دائمی، کدنویسی عامل‌های هوش مصنوعی را خودبهبودبخش کرد

پلتفرم Prime Intellect ابزار متن‌باز Prime Agent را معرفی کرد که به‌جای چت‌های گذرا، از یک محیط اجرای کد دائمی استفاده می‌کند. این سیستم به عامل‌ها اجازه می‌دهد مهارت‌های کدنویسی…

۲ دقیقه خواندن۱
سه پیشگام هوش مصنوعی از متن‌باز ماندن دفاع می‌کنند

سه پیشگام هوش مصنوعی: مدل‌های وزن‌باز مانع انحصار شرکت‌های بزرگ می‌شوند

جفری هینتون، فی‌فی لی و اندرو ان‌جی هشدار دادند که کنترل دسترسی به هوش مصنوعی توسط چند شرکت، نوآوری جهانی را متوقف می‌کند. آن‌ها معتقدند مدل‌های وزن‌باز برای جلوگیری از ایجاد…

۵ دقیقه خواندن۱
بازمهندسی دستورات مدل زبانی از متن خروجی با دقت بالا

«ریسک امنیتی شدید»؛ دسترسی به دستورات محرمانه هوش مصنوعی از روی پاسخ‌ها

روشی جدید برای استخراج دقیق دستورات اولیه (Prompts) از روی متن‌های تولیدشده توسط هوش مصنوعی ابداع شده است. این یافته ریسک امنیتی شدیدی برای شرکت‌هایی که از پرامپت‌های سیستمی…

۳ دقیقه خواندن۲
آموزش پسا Tulu 3 با SFT، DPO، RLVR، GRPO و ارزیابی مبتنی بر تأییدکننده
آموزش کاربردی

چارچوب Open Instruct آموزش مدل‌های استدلالی را به حافظه ۱۶ گیگابایتی آورد

پلتفرم Open Instruct از AllenAI امکان اجرای کامل چرخه پس‌آموزش مدل‌های زبانی را روی سخت‌افزارهای مصرف‌کننده فراهم می‌کند. این سیستم با جایگزینی اجزای توزیع‌شده با پیاده‌سازی‌های…

۱۲ دقیقه خواندن۲
سردرگمی: خواندن صحیح عدد
آموزش کاربردی

تلهٔ توکن‌سازی؛ چرا مقایسهٔ Perplexity بین مدل‌های مختلف گمراه‌کننده است

معیار Perplexity به دلیل وابستگی شدید به توکن‌ساز (Tokenizer) هر مدل، برای مقایسهٔ مدل‌های مختلف نامعتبر است. در واقع، یک توکن‌ساز بهینه‌تر می‌تواند نمرهٔ مدل را روی کاغذ بدتر…

۶ دقیقه خواندن
ساخت مجموعه داده صدای شخصی
آموزش کاربردی

۲۰ نمونهٔ متنی برتر؛ جایگزینی کارآمد برای تنظیم دقیق در شبیه‌سازی لحن

یک متدولوژی جدید نشان می‌دهد که استفاده از ۲۰ تا ۴۰ نمونهٔ منتخب در پرامپت، برای بازتولید سبک شخصی نویسنده بسیار مؤثرتر از تنظیم دقیق مدل است. این روش با تمرکز بر ساختار جملات…

۹ دقیقه خواندن۱
صفحه مدل زبانی کیوئن ۳.۸-۲.۴T-A95B در پلتفرم هاگینگ‌فیس

علی‌بابا: ۲.۴ تریلیون پارامتر برای اجرای وظایف عامل‌محور در Qwen3.8

تیم Qwen علی‌بابا مدل Qwen3.8 را با معماری MoE و ۲.۴ تریلیون پارامتر برای وظایف پیچیده و عامل‌محور منتشر کرد. این مدل با هدف ارتقای توانایی‌های کدنویسی و پژوهش‌های تخصصی،…

۸ دقیقه خواندن۳
لوگوی bb
آموزش کاربردی

bb: محیط توسعه‌ای که قابلیت‌های خود را با عامل‌های هوش مصنوعی می‌سازد

ابزار bb یک IDE متن‌باز و محلی است که به توسعه‌دهندگان اجازه می‌دهد ابزارهای داخلی و پلاگین‌های محیط کدنویسی را با استفاده از عامل‌های هوش مصنوعی طراحی و شخصی‌سازی کنند. این…

۲ دقیقه خواندن۲