
چگونه مدلهای جدید طراحی آزمون، مزیت بازیابی اطلاعات AI را میگیرند؟
با گسترش ابزارهای هوش مصنوعی، مؤسسات آموزشی در حال جایگزینی سیستمهای نظارتی با مدلهای «امنیت در طراحی» هستند. این رویکرد بهجای حافظه، بر تفکر انتقادی و کاربرد تئوری تمرکز…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۵ مقاله منتشر شده

با گسترش ابزارهای هوش مصنوعی، مؤسسات آموزشی در حال جایگزینی سیستمهای نظارتی با مدلهای «امنیت در طراحی» هستند. این رویکرد بهجای حافظه، بر تفکر انتقادی و کاربرد تئوری تمرکز…

قابلیت جدید Pet Memory در اکوسیستم گوگل تلاش میکند حیوانات خانگی را از طریق دوربینهای Nest شناسایی کند، اما آزمایشهای واقعی نشان میدهد مدل در تفکیک حیوانات از یک گونه شکست…

پژوهشهای جدید نشان میدهد هوشمندی حاصل از «تفکر طولانیتر» مدلها در زمان استنتاج را میتوان به وزنهای مدل منتقل کرد. این فرآیند اجازه میدهد شبکه عصبی در یک گذر واحد، نتایجی را…

شش آژانس سایبری کشورهای Five Eyes نخستین راهنمای مشترک برای امنیت عاملهای خودمختار منتشر کردند. این چارچوب تأکید میکند که سازمانها باید مهار ریسک و قابلیت بازگشتپذیری را بر…

یک چارچوب عملی جدید نشان میدهد چگونه میتوان از مدلهای زبانی بزرگ بهعنوان بازبین اول کد استفاده کرد. این سیستم با ترکیب تغییرات گیت (git diff) و دفترچه قوانین تیم، خستگی…

آنتروپیک با معرفی ابزار Read در Claude Code، یک کانال اجباری برای ادراک محیطی ایجاد کرده است که هرگونه ویرایش کد را مشروط به خواندن واقعی فایل میکند. این سازوکار با حذف…

سازمان حفاظت از دادههای برزیل (ANPD) استفاده از تشخیص چهره خودکار در مدارس را متوقف کرد. این تصمیم پس از آن اتخاذ شد که خطاهای فنی سیستم، پرداختهای حمایتی خانوادههای کمدرآمد…

شرکت Cartesia مدل Sonic-3.6 را معرفی کرد که با جایگزینی ترنسفورمرها با مدلهای فضای حالت (SSM)، تأخیر استنتاج را به زیر ۹۰ میلیثانیه رسانده است. این مدل در حال حاضر رتبه اول هر…

دادههای Vercel نشان میدهد آنتروپیک با وجود سهم ۳۰ درصدی از حجم توکنها، ۶۵ درصد از کل هزینهها را به خود اختصاص داده است. این تضاد نشاندهندهٔ تمایل شدید توسعهدهندگان به پرداخت…

شرکت LG با همکاری انویدیا در حال ساخت یک «کارخانه داده» در سئول است تا تا پایان سال ۲۰۲۶، ۱۰۰ هزار ساعت داده آموزشی تولید کند. هدف این پروژه، خلق یک مدل بنیادی جامع برای رباتهای…

استفاده از دادههای مصنوعی بهعنوان یک ابزار خودکار برای حفظ حریم خصوصی، یک باور اشتباه و خطرناک است. چارچوب فنی جدید تأکید میکند که این دادهها باید از چهار لایه سختگیرانه…

مدل جدید و وزنباز Qwen 3.8 27B از علیبابا، با کسب بالاترین امتیاز هوشمندی در میان ۱۳۵ مدل هماندازه، سقف جدیدی برای کارایی مدلهای میانمقیاس تعریف کرد. این مدل با پنجره متنی…