ocr-it es una extensión para Chrome pensada para extraer texto de documentos paginados que no permiten seleccionar ni copiar el contenido, como libros escaneados, presentaciones o visores PDF embebidos. El usuario define una vez la región de la pantalla que contiene el texto y, a partir de ahí, una combinación de teclas (⌥⇧S) captura esa zona, ejecuta OCR en local con una copia empaquetada de Tesseract y añade el texto a una transcripción continua. Una segunda combinación (⌥⇧A) activa un modo automático que captura la página, la gira y repite el ciclo hasta el final del documento, con detección de fin por repetición y un tope configurable de 300 páginas.
El OCR funciona íntegramente en el equipo: la extensión no realiza peticiones de red, no envía imágenes a servicios externos y no solicita acceso global a sitios en la instalación, solo permisos puntuales sobre la pestaña activa cuando se pulsa el atajo. La página se gira mediante coordenadas en pantalla en lugar de selectores CSS, lo que permite actuar sobre iframes de origen cruzado y shadow DOM, aunque no sobre el visor PDF nativo de Chrome. La herramienta incluye por defecto modelos de inglés, portugués y español, y admite añadir los más de cien idiomas de Tesseract empaquetándolos manualmente en la carpeta vendor/. El resultado se exporta como texto plano, útil para alimentar a un modelo de lenguaje con un libro que no se podía copiar.
