پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۲٬۰۴۳ مقاله منتشر شده

پرداخت برای هوش مصنوعی خارجی از ایران: واقعیت، خطرها و جایگزین رایگان
آموزش کاربردی

پرداخت برای هوش مصنوعی خارجی از ایران: واقعیت، خطرها و جایگزین رایگان

برای کاربر داخل ایران، پرداخت به هوش مصنوعیِ خارجی (ChatGPT، Claude) ذاتاً سخت است: تحریم‌ها سرویس‌ها را مسدود کرده‌اند و کارت ایرانی روی سرویس بین‌المللی کار نمی‌کند. روش‌هایی که…

۵ دقیقه خواندن۱
گزارش arXiv: کاهش ۳۶ درصدی موفقیت جیل‌بریک در مدل‌های استدلالی با متد Safe

گزارش arXiv: کاهش ۳۶ درصدی موفقیت جیل‌بریک در مدل‌های استدلالی با متد Safe

پژوهشگران روشی به نام Safe Trigger ابداع کرده‌اند که به مدل‌های استدلالی اجازه می‌دهد با تحلیل مسیر تفکر خود، درخواست‌های مضر را شناسایی و مسدود کنند. این رویکرد نیاز به داده‌های…

۱ دقیقه خواندن۱
چگونه تبدیل دستورالعمل‌های متنی به وزن‌های رفتاری، هزینه‌ی استنتاج را می‌کاهد؟

چگونه تبدیل دستورالعمل‌های متنی به وزن‌های رفتاری، هزینه‌ی استنتاج را می‌کاهد؟

پژوهشگران چارچوب **Skill-to-LoRA** (S2L) را معرفی کرده‌اند که دستورالعمل‌های متنی حجیم در پرامپت‌ها را با آداپتورهای سبک **LoRA** جایگزین می‌کند. این رویکرد باعث کاهش ۶.۶ درصدی…

۲ دقیقه خواندن
پدیده Idle-drift در Claude Haiku 4.5؛ وقتی برنامه‌ریزی دقیق به بی‌عملی منجر

پدیده Idle-drift در Claude Haiku 4.5؛ وقتی برنامه‌ریزی دقیق به بی‌عملی منجر

بنچمارک جدید CoffeeBench نشان می‌دهد که برخی مدل‌های زبانی با وجود توانایی برنامه‌ریزی دقیق، در محیط‌های اقتصادی بلندمدت دچار «بی‌عملی» می‌شوند. Claude Haiku 4.5 در این آزمون…

۱ دقیقه خواندن
چرا ادغام تک‌مرحله‌ای مدل‌های زبانی در وظایف تخصصی شکست می‌خورد؟

چرا ادغام تک‌مرحله‌ای مدل‌های زبانی در وظایف تخصصی شکست می‌خورد؟

پژوهشگران متد METIS را برای حل مشکل «پاک‌شدن اطلاعات» در ادغام مدل‌ها معرفی کردند. این روش با جایگزینی تجمیع یک‌باره با یک پروتکل تکرارشونده، مانع از تداخل وظایف شده و عملکرد…

۱ دقیقه خواندن۲
ابزارهای رایگان هوش مصنوعی برای کارهای روزمره؛ کدام‌ها از داخل ایران در دسترس‌اندویژه
آموزش کاربردی

ابزارهای رایگان هوش مصنوعی برای کارهای روزمره؛ کدام‌ها از داخل ایران در دسترس‌اند

هوش مصنوعی پر است از ابزارهای رایگان، اما برای کاربر ایرانی پرسشِ اصلی این نیست که کدام بهتر است؛ این است که کدام واقعاً از داخل باز می‌شود و کدام برای ثبت‌نام یا ارتقا به شماره و…

۶ دقیقه خواندن۴
جایگاه در لیست: متغیری که توصیه‌های مدل‌های زبانی را ۱۲ دلار جابه‌جا می‌کند

جایگاه در لیست: متغیری که توصیه‌های مدل‌های زبانی را ۱۲ دلار جابه‌جا می‌کند

یک ممیزی روی ۱۲ مدل هوش مصنوعی نشان می‌دهد که جایگاه یک هتل در لیست داده‌ها، به‌طور مستقل بر توصیه‌ی مدل اثر می‌گذارد. این سوگیری ساختاری باعث می‌شود ارزش ادراکی هر اتاق شبانه…

۱ دقیقه خواندن۲
گزارش arXiv: بازدهی ۵۹.۳ درصدی LiteOdyssey در تشخیص بیماری‌های فوق‌کمیاب

گزارش arXiv: بازدهی ۵۹.۳ درصدی LiteOdyssey در تشخیص بیماری‌های فوق‌کمیاب

چارچوب استدلالی سبک‌وزن LiteOdyssey با تکیه بر سیاست‌های همکاری انسان-ماشین، در تشخیص بیماری‌های بسیار نادر از GPT-5.4 پیشی گرفت. این دستاورد نشان می‌دهد که ساختار استدلالی دقیق…

۲ دقیقه خواندن
چگونه تفکر مبنی‌ساز، توانایی استدلالی Gemma3-4B را به سطح مدل ۲۷ میلیارد

چگونه تفکر مبنی‌ساز، توانایی استدلالی Gemma3-4B را به سطح مدل ۲۷ میلیارد

محققان با معرفی روش «تفکر مبنی‌ساز»، مدل‌های کوچک را قادر ساختند تا گام‌های استدلالی خود را به نقاط دقیق تصویر متصل کنند. این رویکرد باعث شد مدل Gemma3-4B-IT در استدلال‌های مکانی،…

۲ دقیقه خواندن۱
چرا ۸۴ درصد از تست‌های پایداری هوش مصنوعی در شناسایی شکست‌ها ناکام می‌مانند؟

چرا ۸۴ درصد از تست‌های پایداری هوش مصنوعی در شناسایی شکست‌ها ناکام می‌مانند؟

پروژه llcore نشان می‌دهد تکیه بر مشاهده رفتار مدل برای تضمین پایداری، یک توهم است و ۸۴ درصد شکست‌های خطرناک را نادیده می‌گیرد. تنها گواهینامه‌های ریاضی می‌توانند پایداری را تضمین…

۴ دقیقه خواندن۱
Snaply.ai در برابر Whisperflow؛ کدام ابزار تبدیل صوت به متن برای مک برنده است؟
آموزش کاربردی

Snaply.ai در برابر Whisperflow؛ کدام ابزار تبدیل صوت به متن برای مک برنده است؟

ابزارهای تبدیل صوت به متن محلی در مک‌های سری M جایگزین سرویس‌های ابری شده‌اند. Snaply.ai به دلیل رایگان بودن، قابلیت آفلاین و تمرکز بر حریم خصوصی، به پیشنهاد اول کاربران تبدیل شده…

۱ دقیقه خواندن