
مدلهای بازمتن اثربخشیِ محدودیتهای صادراتی آمریکا را کاهش دادند
دولت آمریکا دسترسی خارجی به مدلهای پیشرفته Anthropic را به دلیل مخاطرات امنیتی مسدود کرد. با این حال، کارشناسان هشدار میدهند که محدود کردن یک شرکت بیفایده است، زیرا قابلیتهای…
موضوع
Open-source models, open weights, local hosting, licensing
۱٬۲۵۷ مقاله منتشر شده

دولت آمریکا دسترسی خارجی به مدلهای پیشرفته Anthropic را به دلیل مخاطرات امنیتی مسدود کرد. با این حال، کارشناسان هشدار میدهند که محدود کردن یک شرکت بیفایده است، زیرا قابلیتهای…

پژوهشگران با معرفی معماری NAG مانع از زوال سیگنال در مدلهای ترنسفورمر میشوند. این رویکرد با جداسازی اندازه از جهت در جریان باقیمانده، امکان ایجاد مدلهای بسیار عمیق و بهینه را…

پژوهشگران چارچوب VinQA را برای ارزیابی توانایی مدلهای هوش مصنوعی در استناد دقیق به عناصر بصری (جداول و نمودارها) در پاسخهای طولانی معرفی کردند. نتایج نشان میدهد تنظیم دقیق…

تحلیلی روی ۵۶ هزار مقاله طی یک دهه نشان میدهد که نرخ اشتراکگذاری کد و داده از ۱۱٪ به ۶۴٪ رسیده است. این دادهها حاکی از یک چرخش فرهنگی بنیادین به سوی «علم باز» و پایان بحران…

هر چیزی که در یک هوش مصنوعیِ ابری مثلِ ChatGPT مینویسید از دستگاهِ شما خارج میشود و به سرورهای آن شرکت در خارج میرود، جایی که ممکن است ذخیره شود، دیده شود یا برای آموزشِ…

هوش مصنوعیِ ابری مثلِ ChatGPT و Claude از ایران مسدود است و پرداختِ بینالمللی میخواهد — اما مدلهای متنباز روی سیستمِ خودتان اجرا میشوند: رایگان، بدونِ مسدودسازی و کاملاً…

برای کاربر داخل ایران، پرداخت به هوش مصنوعیِ خارجی (ChatGPT، Claude) ذاتاً سخت است: تحریمها سرویسها را مسدود کردهاند و کارت ایرانی روی سرویس بینالمللی کار نمیکند. روشهایی که…

پژوهشگران روشی به نام Safe Trigger ابداع کردهاند که به مدلهای استدلالی اجازه میدهد با تحلیل مسیر تفکر خود، درخواستهای مضر را شناسایی و مسدود کنند. این رویکرد نیاز به دادههای…

پژوهشگران چارچوب **Skill-to-LoRA** (S2L) را معرفی کردهاند که دستورالعملهای متنی حجیم در پرامپتها را با آداپتورهای سبک **LoRA** جایگزین میکند. این رویکرد باعث کاهش ۶.۶ درصدی…

بنچمارک جدید CoffeeBench نشان میدهد که برخی مدلهای زبانی با وجود توانایی برنامهریزی دقیق، در محیطهای اقتصادی بلندمدت دچار «بیعملی» میشوند. Claude Haiku 4.5 در این آزمون…

پژوهشگران متد METIS را برای حل مشکل «پاکشدن اطلاعات» در ادغام مدلها معرفی کردند. این روش با جایگزینی تجمیع یکباره با یک پروتکل تکرارشونده، مانع از تداخل وظایف شده و عملکرد…
ویژههوش مصنوعی پر است از ابزارهای رایگان، اما برای کاربر ایرانی پرسشِ اصلی این نیست که کدام بهتر است؛ این است که کدام واقعاً از داخل باز میشود و کدام برای ثبتنام یا ارتقا به شماره و…