Noticias que mencionan tesseract

El teseracto: visualizando cuatro dimensiones

Este artículo explora la visualización del teseracto (o hipercubo), una analogía de cuatro dimensiones de un cubo. A menudo visto en ciencia ficción, comprender cómo se generan estas representaciones visuales puede ser complejo. El artículo comienza explicando cómo construir un modelo matemático del

25 años rastreando el precio de los huevos

Este artículo relata un proyecto personal de 25 años para rastrear el precio de los huevos a través de recibos escaneados, utilizando tecnologías de vanguardia como agentes de codificación con IA (Codex y Claude) y modelos de visión por computadora. El autor comenzó en 2001 guardando imágenes de rec

IA y OCR: La Realidad Distante de las Promesas

Un reciente informe basado en discusiones anónimas en foros de ingeniería y comunidades de practicantes revela una desconexión significativa entre las demostraciones de rendimiento de la tecnología OCR (Reconocimiento Óptico de Caracteres) e IA (Inteligencia Artificial) y su funcionamiento en entorn

Vulnerabilidad Noroboto: fuentes engañan a sistemas de IA legal

El artículo de Tritium Legal Technologies explora una vulnerabilidad emergente en la forma en que los sistemas de tecnología legal modernos procesan documentos, particularmente aquellos que contienen fuentes. Se denomina “Noroboto” y se basa en la manipulación de fuentes TrueType para engañar a los

LiteParse: el parser de documentos OSS de LlamaIndex que ejecuta todo en local

LiteParse es una herramienta de código abierto para el parseo de documentos lanzada por LlamaIndex. Diseñada para ejecutarse íntegramente en local, ofrece análisis de texto espacial con cajas delimitadoras, sin depender de servicios en la nube ni de modelos de lenguaje propietarios. La arquitectura

Cómo obtener gradientes exactos de código Fortran gracias a LFortran y Enzyme

El blog Tesseract presenta una cadena de compilación experimental que permite derivar automáticamente código Fortran heredado y obtener gradientes exactos sin reescribirlo en JAX o PyTorch. La propuesta combina LFortran, LLVM y Enzyme, un sistema de diferenciación automática que opera a nivel de LLV

Una extensión de Chrome para digitalizar libros paginados con OCR local

ocr-it es una extensión para Chrome pensada para extraer texto de documentos paginados que no permiten seleccionar ni copiar el contenido, como libros escaneados, presentaciones o visores PDF embebidos. El usuario define una vez la región de la pantalla que contiene el texto y, a partir de ahí, una

Rotaciones en cuatro dimensiones mediante álgebra geométrica

El álgebra geométrica ofrece un marco matemático potente para describir rotaciones en espacios de dimensiones superiores, generalizando los métodos utilizados en dos y tres dimensiones. En este contexto, las rotaciones en cuatro dimensiones se calculan de manera análoga a las tridimensionales en cas