پرش به محتوای اصلی
پرش به محتوای مقاله

Hister: موتور جست‌وجوی شخصی برای فایل‌های محلی و تاریخچه وب

·۲۶ شهریور ۱۴۰۵۳ دقیقه مطالعه۱ بازدید
موتور جستجوی شخصی: راه‌حلی متن‌باز برای ساخت موتور جستجوی اختصاصی با قابلیت کنترل کامل بر داده‌ها
موتور جستجوی شخصی: راه‌حلی متن‌باز برای ساخت موتور جستجوی اختصاصی با قابلیت کنترل کامل بر داده‌ها
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

ترکیب ایندکس‌گذاری متن کامل محلی با پروتکل MCP؛ این یعنی برای نخستین بار می‌توان به یک مدل زبانی دسترسی مستقیم و خصوصی به تمام تاریخچه وب و فایل‌های محلی داد، بدون اینکه داده‌ها از محیط کاربر خارج شوند.

تصور کنید تمام ردپای دیجیتال شما در پوشه‌های پراکنده و تاریخچه مرورگر گم شده است و یافتن یک جزئیات کوچک، ساعت‌ها زمان می‌برد. Hister با تبدیل این داده‌های پراکنده به یک پایگاه‌داده قابل جست‌وجو، این مشکل را به‌طور ریشه‌ای حل می‌کند.

بسیاری از ما برای مدیریت دانش شخصی به بوک‌مارک‌ها یا ابزارهای ابری متکی هستیم که در واقع با داده‌های ما درآمدزایی می‌کنند. Hister که در ۱۷ سپتامبر ۲۰۲۶ عرضه شد، این معادله را تغییر می‌دهد و تمام محتوای ایندکس‌شده را روی سرور محلی شما نگه می‌دارد. این ابزار شبیه به یک بایگانی شخصی است که هر چه در وب می‌خوانید را برایتان یادداشت می‌کند، اما کلید گاوصندوق فقط در دست شماست. همان‌طور که در بحث‌های گذشته ما درباره‌ی میزبانی شخصی (Self-hosting) اشاره کردیم، کنترل روی زیرساخت، تنها راه تضمین حریم خصوصی است.

به نقل از مستندات این پروژه در گیت‌هاب، این سیستم بر پایه معماری سرور-کلاینت عمل می‌کند. شما می‌توانید فایل اجرایی آن را برای ویندوز، مک یا لینوکس نصب کنید یا از طریق Docker و Homebrew آن را مستقر کنید. پس از اجرا، یک افزونه برای کروم یا فایرفاکس، محتوای صفحات بازدیدشده را به‌طور خودکار برای ایندکس شدن به سرور محلی شما می‌فرستد.

موتور جستجوی شخصی: راه‌حلی متن‌باز برای ساخت موتور جستجوی اختصاصی با قابلیت کنترل کامل بر داده‌ها

بر اساس مستندات فنی، قابلیت‌های کلیدی این ابزار عبارتند از:

  • ایندکس‌گذاری متن کامل: جست‌وجو در بدنه واقعی صفحات و فایل‌ها، نه فقط متاداده‌ها یا URLها.
  • پرس‌وجوی منعطف: پشتیبانی از کاراکترهای جایگزین (Wildcards)، فیلترهای میدانی و اولویت‌بندی نتایج.
  • دسترسی چندگانه: امکان جست‌وجو از طریق رابط کاربری وب، رابط متنی ترمینال (TUI) یا خط فرمان.
  • یکپارچگی با هوش مصنوعی: اتصال به دستیارهای هوش مصنوعی از طریق پروتکل زمینهٔ مدل (MCP).

موتور جستجوی شخصی hister در گیت‌هاب: ابزاری متن‌باز برای ساخت موتور جستجوی اختصاصی.

برای کسانی که به دنبال کشفیات عمیق‌تر هستند، Hister قابلیت جست‌وجوی معنایی (Semantic Search) را ارائه می‌دهد. این قابلیت — که شبیه به درک مفهوم یک جمله است، حتی اگر کلمات دقیقاً یکی نباشند — با پیکربندی یک نقطه اتصال برای بردار معنایی (Embedding) فعال می‌شود. همچنین این سیستم از محیط‌های چندکاربره پشتیبانی می‌کند تا هر کاربر ایندکس مجزای خود را داشته باشد.

این ابزار این فرض را می‌شکند که مدیریت دانش شخصی لزوماً به اشتراک ماهانه یا حساب ابری نیاز دارد. Hister با تبدیل تاریخچه وب به یک پایگاه‌داده، لیستی غیرفعال از لینک‌ها را به یک پایگاه دانش فعال و خصوصی تبدیل می‌کند.

توسعه‌دهندگان باید بدانند که این پروژه تحت لایسنس AGPLv3 منتشر شده و برای بیلد محلی به Go 1.26 و npm نیاز دارد. شما می‌توانید با وارد کردن تاریخچه فعلی مرورگر یا ایندکس کردن پوشه‌های محلی، اولین نتایج جست‌وجوی خود را ایجاد کنید.

گام بعدی شما

  • آخرین نسخه را از گیت‌هاب دانلود و روی سرور محلی یا لپ‌تاپ خود نصب کنید.
  • افزونه مرورگر مربوطه را فعال کنید تا شروع به جمع‌آوری محتوای صفحات کنید.
  • اگر توسعه‌دهنده هستید، اتصال آن را به یک مدل زبانی از طریق MCP تست کنید تا بتوانید با داده‌های محلی خود چت کنید.

اما داستان سخت‌افزاری برای اجرای بهینه این مدل‌ها حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این ابزار با حذف واسطه‌های ابری، مالکیت داده‌های دیجیتال را به کاربر بازمی‌گرداند. اعتبار این رویکرد در استفاده از استانداردهای باز مانند MCP است که اجازه می‌دهد کاربر بدون افشای حریم خصوصی، از قدرت هوش مصنوعی برای تحلیل تاریخچه شخصی خود استفاده کند.

تأثیر برای ایران

به‌دلیل متن‌باز بودن و قابلیت میزبانی شخصی، این ابزار برای کاربران ایرانی که با محدودیت‌های دسترسی به سرویس‌های ابری مواجه‌اند، راهکاری ایده‌آل برای مدیریت دانش خصوصی است.

·نگاه ما
تحریریه دات‌هوش

تمرکز Hister بر پروتکل MCP نشان می‌دهد که آینده مدیریت دانش، نه در ابزارهای یادداشت‌برداری دستی، بلکه در لایه‌های استخراج خودکار داده از رفتار کاربر است. این رویکرد، مرز بین «مرور وب» و «ساخت پایگاه دانش» را از بین می‌برد و داده‌های غیرساختاریافته را برای مدل‌های استدلالی آماده می‌کند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.