تصور کنید یک اشتباه تایپی ساده یا یک کد ملی جعلی، باعث شود تمام سوابق کیفری یا مالی شما به حساب شخص دیگری منتقل شود. این کابوس برای بسیاری از کاربران سیستمهای اداری قدیمی به دلیل تکیه بر دادههای متنی غیرقابلاعتماد به واقعیت تبدیل شده است.
طبق گزارش ۲۲ سپتامبر ۲۰۲۶ از وبسایت dev.to، استفاده از نامهای متنی یا شناسههای دولتی بهعنوان کلید اصلی در پایگاهدادهها، یک «ضدالگوی» مهندسی نرمافزار است. این رویکرد باعث تداخل رکوردها و ایجاد سوابق جعلی میشود، زیرا سیستمهای قدیمی بهجای تأیید تجربی، از تطبیق تقریبی متن استفاده میکنند.
همانطور که در تحلیلهای قبلی ما دربارهی امنیت دادههای زیستسنجی اشاره کردیم، راهکار نهایی در عبور از متن و رسیدن به ریاضیات است. مهندسان اکنون به سمت تأیید جفتبهجفت (Pairwise Verification) با استفاده از بینایی ماشین حرکت میکنند. در این روش، بهجای جستوجو در مجموعههای باز، از شبکههای عصبی پیچشی (CNN) یا ترنسفورمرهای بینایی (Vision Transformers) برای استخراج بردار معنایی (Embedding) — شبیه به یک کارت معرفی عددی که ویژگیهای منحصربهفرد چهره را ثبت میکند — استفاده میشود. این بردارها معمولاً در ابعاد ۱۲۸ یا ۵۱۲ بُعدی هستند.
سازوکار فنی
تأیید هویت در این سیستمها از طریق محاسبه فاصله اقلیدسی بین دو بردار (مثلاً عکس مدرک شناسایی و عکس لحظهای کاربر) انجام میشود:
- آستانه فاصله: سیستمها از یک حد سختگیرانه (مثلاً ۰.۶) برای تشخیص تطابق استفاده میکنند.
- کاهش نرخ پذیرش نادرست (FAR): با کالیبراسیون این آستانهها، توسعهدهندگان میتوانند خطاهای فاجعهبار قانونی را به حداقل برسانند. این دقت در کاهش خطاهای مثبت کاذب، مشابه رویکردی است که در بهینهسازی امنیت قراردادهای هوشمند با ترکیب AI و انسان برای کاهش نرخ مثبت کاذب مشاهده شد.
- حسابرسی تغییرناپذیر: بهجای ذخیره متنهای قابل تغییر، هشهای رمزنگاریشده از بردارها ذخیره میشوند.
این چرخش، فرض بنیادین شناسایی را از «آیا این متنها یکی هستند؟» به «آیا اینها یک شخص فیزیکی هستند؟» تغییر میدهد. برای توسعهدهنده، این یعنی جایگزینی اعتماد به پایگاهدادههای رابطهای با اعتماد به امتیازات اطمینان ریاضی.
به نقل از مستندات فنی این رویکرد، حریم خصوصی دادهها نیز تضمین میشود؛ زیرا مقایسه جفتبهجفت فقط روی عکسهای ارسالی کاربر انجام میگیرد و نیازی به اسکن مجموعههای داده خارجی نیست. این موضوع باعث انطباق کامل خط لوله با استانداردهای سختگیرانه حفاظت از دادهها میشود و ریسکهایی نظیر استثمار خودکار حفرههای امنیتی API را که در مدلهای متنی و متمرکز رایج است، به شدت کاهش میدهد.
گام بعدی شما
- اگر سیستمهای KYC یا ثبت سوابق قانونی توسعه میدهید، بررسی کنید که آیا هنوز به APIهای متنی متکی هستید یا از مدلهای محلی بردار معنایی استفاده میکنید.
- آستانه فاصله (Distance Threshold) مدل خود را بر اساس نرخ پذیرش نادرست (FAR) مورد نیاز کسبوکارتان کالیبره کنید.
- برای امنیت بیشتر، بهجای ذخیره بردار خام، از هشهای رمزنگاریشده استفاده کنید.
اما تأمین سختافزاری برای اجرای این مدلها در مقیاس میلیونی چالشبرانگیز است — به تحلیل ما دربارهی بهینهسازی استنتاج در لبه مراجعه کنید.




گفتگو