
چرا مدلهای چندوجهی در استناد به تصاویر اسناد طولانی شکست میخورند؟
پژوهشگران چارچوب VinQA را برای ارزیابی توانایی مدلهای هوش مصنوعی در استناد دقیق به عناصر بصری (جداول و نمودارها) در پاسخهای طولانی معرفی کردند. نتایج نشان میدهد تنظیم دقیق…
موضوع
Open-source models, open weights, local hosting, licensing
۱٬۹۳۹ مقاله منتشر شده

پژوهشگران چارچوب VinQA را برای ارزیابی توانایی مدلهای هوش مصنوعی در استناد دقیق به عناصر بصری (جداول و نمودارها) در پاسخهای طولانی معرفی کردند. نتایج نشان میدهد تنظیم دقیق…

تحلیلی روی ۵۶ هزار مقاله طی یک دهه نشان میدهد که نرخ اشتراکگذاری کد و داده از ۱۱٪ به ۶۴٪ رسیده است. این دادهها حاکی از یک چرخش فرهنگی بنیادین به سوی «علم باز» و پایان بحران…

هر چیزی که در یک هوش مصنوعیِ ابری مثلِ ChatGPT مینویسید از دستگاهِ شما خارج میشود و به سرورهای آن شرکت در خارج میرود، جایی که ممکن است ذخیره شود، دیده شود یا برای آموزشِ…

هوش مصنوعیِ ابری مثلِ ChatGPT و Claude از ایران مسدود است و پرداختِ بینالمللی میخواهد — اما مدلهای متنباز روی سیستمِ خودتان اجرا میشوند: رایگان، بدونِ مسدودسازی و کاملاً…

برای کاربر داخل ایران، پرداخت به هوش مصنوعیِ خارجی (ChatGPT، Claude) ذاتاً سخت است: تحریمها سرویسها را مسدود کردهاند و کارت ایرانی روی سرویس بینالمللی کار نمیکند. روشهایی که…

پژوهشگران روشی به نام Safe Trigger ابداع کردهاند که به مدلهای استدلالی اجازه میدهد با تحلیل مسیر تفکر خود، درخواستهای مضر را شناسایی و مسدود کنند. این رویکرد نیاز به دادههای…

پژوهشگران چارچوب **Skill-to-LoRA** (S2L) را معرفی کردهاند که دستورالعملهای متنی حجیم در پرامپتها را با آداپتورهای سبک **LoRA** جایگزین میکند. این رویکرد باعث کاهش ۶.۶ درصدی…

بنچمارک جدید CoffeeBench نشان میدهد که برخی مدلهای زبانی با وجود توانایی برنامهریزی دقیق، در محیطهای اقتصادی بلندمدت دچار «بیعملی» میشوند. Claude Haiku 4.5 در این آزمون…

پژوهشگران متد METIS را برای حل مشکل «پاکشدن اطلاعات» در ادغام مدلها معرفی کردند. این روش با جایگزینی تجمیع یکباره با یک پروتکل تکرارشونده، مانع از تداخل وظایف شده و عملکرد…
ویژههوش مصنوعی پر است از ابزارهای رایگان، اما برای کاربر ایرانی پرسشِ اصلی این نیست که کدام بهتر است؛ این است که کدام واقعاً از داخل باز میشود و کدام برای ثبتنام یا ارتقا به شماره و…

یک ممیزی روی ۱۲ مدل هوش مصنوعی نشان میدهد که جایگاه یک هتل در لیست دادهها، بهطور مستقل بر توصیهی مدل اثر میگذارد. این سوگیری ساختاری باعث میشود ارزش ادراکی هر اتاق شبانه…

چارچوب استدلالی سبکوزن LiteOdyssey با تکیه بر سیاستهای همکاری انسان-ماشین، در تشخیص بیماریهای بسیار نادر از GPT-5.4 پیشی گرفت. این دستاورد نشان میدهد که ساختار استدلالی دقیق…