TXR es un lenguaje de programación pragmático y versátil, diseñado para facilitar el procesamiento de datos y la extracción de información desde fuentes de texto arbitrarias. Desarrollado desde 2009, su manual de referencia, de 778 páginas, lo posiciona como una herramienta robusta para tareas de 'hacking' diario. El sistema se distingue por su dualidad: combina un lenguaje de coincidencia de patrones para el raspado de datos con un lenguaje de procesamiento de datos basado en Lisp, conocido como TXR Lisp, que permite resolver problemas complejos con concisión.
TXR Lisp soporta compilación a código para una máquina virtual basada en registros, optimizando funciones individuales y archivos mediante técnicas como la eliminación de código muerto y el plegado de constantes. El ejecutable principal ocupa aproximadamente 1,7 megabytes, superando en tamaño a GNU Awk, y depende únicamente de libffi para sus dependencias externas. Su huella de memoria es eficiente, consumiendo alrededor de 18 megabytes en picos durante la compilación de la biblioteca estándar. El proyecto valora la brevedad del código y está abierto a contribuciones de hackers que deseen mejorar sus características o incorporar nuevas técnicas de otras lenguajes.
Aunque el proyecto es de código abierto bajo la licencia BSD, el equipo de TXR emite una advertencia crítica: no se debe utilizar la versión empaquetada por Homebrew, ya que los informes indican que el ejecutable es inestable y no se ejecutan las pruebas de construcción. Se recomienda construir el software desde fuentes para garantizar la estabilidad y la fiabilidad de las herramientas.
