Hister: un motor de búsqueda personal que indexa páginas, archivos e historial en tu propio servidor

Fuentes: Hister: a personal search engine that indexes pages, files, and history on your own server

Hister es una herramienta de software libre, publicada bajo licencia AGPLv3, que convierte las páginas web visitadas, los archivos locales y el historial del navegador en un índice de búsqueda de texto completo controlado por el usuario. Funciona como un motor de búsqueda personal: una extensión de navegador guarda las páginas consultadas, unos vigilantes de carpetas añaden los ficheros del disco y un crawler permite importar sitios completos o el historial previo. El contenido se extrae, se procesa con reglas configurables y se indexa en un servidor elegido por el usuario, que puede ser la propia máquina local.

El sistema se distribuye como un único binario y no incluye telemetría ni conexiones externas obligatorias: cualquier solicitud saliente, como la búsqueda semántica opcional o la descarga de faviconos, se dirige al endpoint que el usuario configure. Los datos extraídos, las reglas de indexado y el contenido de las páginas se almacenan en el servidor Hister y permanecen bajo su control.

La búsqueda admite campos, frases exactas, comodines, negación, rangos de fechas, prioridades y alias definidos por el usuario. Los resultados se acompañan de una vista previa legible del documento sin abandonar la consulta. El índice está disponible mediante interfaz web, cliente de terminal, línea de comandos, API HTTP y un servidor MCP, lo que permite también integrarlo con asistentes de IA. Hister soporta múltiples backends de crawler, índices por idioma, versionado de contenido, reglas de propiedad y extractores configurables, y admite usuarios diferenciados con SQLite o PostgreSQL.