
هزینههای خطی و توهمات انتهایی؛ دلیل شکست خلاصهسازی اسناد بلند در مقیاس صنعتی
گسترش قابلیت خلاصهسازی مدلهای زبانی از دمو به محیط تولید، بهدلیل افزایش شدید هزینهها و توهمات در انتهای متن با شکست مواجه شده است. تحلیلهای فنی نشان میدهد که خوانش…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۵۰ مقاله منتشر شده

گسترش قابلیت خلاصهسازی مدلهای زبانی از دمو به محیط تولید، بهدلیل افزایش شدید هزینهها و توهمات در انتهای متن با شکست مواجه شده است. تحلیلهای فنی نشان میدهد که خوانش…

بسیاری از عاملهای هوش مصنوعی در محیط عملیاتی بهدلیل نبود حافظه پایدار و حلقههای شکننده API شکست میخورند. معماری جدید با تفکیک استدلال از حافظه محلی و استفاده از مدلهای…

پژوهشگران Accomplish AI یک نقص امنیتی بحرانی در Claude Cowork کشف کردند که اجازه میدهد عاملها از محیط ایزوله خارج شده و به فایلهای حساس سیستم میزبان دسترسی یابند. آنتروپیک با…

گزارش جدید AI Forensics نشان میدهد اکثر مدلهای ویرایش تصویر در Hugging Face فاقد حفاظهای پایه هستند. این وضعیت امکان تولید جعلهای عمیق جنسی را تنها با پرامپتهای ساده فراهم…

پیشرفتهای سریع در مدلهای انتشار صوتی و آواتارهای چهره، مفهوم «اثبات حضور» بیومتریک را از بین برده است. توسعهدهندگان باید از این پس با سیگنالهای بیومتریک، نه بهعنوان هویت،…

یک اسکنر جدید به مهندسان اجازه میدهد بدون دسترسی به وزنهای داخلی، رفتار مدلهای زبانی را از طریق مقایسه پاسخهای پایه با تغییرات متضاد تحلیل کنند. این گردشکار با استفاده از…

یک گردشکار فنی جدید امکان اجرای مدل بسیار فشرده Bonsai-27B را روی سختافزارهای معمولی فراهم کرد. کاربران با استفاده از نسخه اختصاصی PrismML از llama.cpp میتوانند این مدل ۱-بیتی…

یک ابزار متنباز جدید با ایجاد یک تورنمنت رقابتی بین مدلهای هوش مصنوعی، آنها را مجبور میکند تا کدهای یکدیگر را نقد کنند. این سیستم با پنهان کردن امتیازها و شرطی کردن مراحل بر…

بنچمارک جدید Mininglamp نشان میدهد مدلهای فعلی تنها در ۲۰٪ موارد موفق به تکمیل کامل وظایف در وب زنده میشوند. این فاصله عمیق بین «ناوبری ساده» و «اتمام عملیات»، چالش اصلی مسیر…

شرکت Fermion Research مدل Neutrino-1 8B را معرفی کرد که با استفاده از یک فرمت وزنی ترنری، اثر حافظهای مدل را تا ۸۷.۵٪ کاهش میدهد. این مدل امکان استنتاج سریع روی سختافزارهای…

پروتکل زمینهٔ مدل (MCP) اثر شرکت انتروپیک، تعامل مدلهای هوش مصنوعی با دادههای خارجی را استاندارد میکند. این رویکرد برخلاف روشهای سنتی، ابزارها را از مدلها جدا کرده و مشابه…

یک بنچمارک جدید نشان میدهد Claude Code هنگام ساخت بکاندها از ابتدا، دچار عدم ثبات ساختاری شده و توکنهای بیشتری مصرف میکند. استفاده از مهارتهای استاندارد Fonderie مصرف توکن را…