bzip3: un sucesor espiritual de BZip2 con mejor compresión y mayor velocidad

bzip3 es una herramienta de compresión de datos que se presenta como sucesora espiritual de BZip2, con el objetivo de superar a su antecesora tanto en ratio de compresión como en velocidad. Como BZip2, está especialmente indicada para comprimir texto o código fuente. Su arquitectura combina varias

Cómo Full Quiet comprime un mundo abierto en medio megabyte de NES

Full Quiet, un juego de mundo abierto para la consola NES de 8 bits, almacena su mundo en un cartucho de apenas medio megabyte gracias a un sistema de compresión por capas que afecta tanto a los textos como a los gráficos. El artículo del desarrollador Pino describe paso a paso las técnicas empleada

Construyamos un compresor desde cero

La compresión de datos permite reescribir la información para que ocupe menos bytes sin perder contenido. El artículo parte de un ejemplo sencillo: ocho valores booleanos codificados como JSON ocupan 52 bytes, pero como cadena de bits caben en uno solo. A partir de ahí se presentan los algoritmos ge

Por qué comprimir datos es, en el fondo, predecirlos

El blog de ngrok publica un artículo didáctico que explica la relación profunda entre la compresión de datos y el modelado de lenguaje. El texto parte de la idea de que compresores como gzip o Brotli y los modelos de lenguaje grandes (LLM) resuelven, en esencia, el mismo problema: predecir la redund

Por qué ryg_rans no es una librería y qué usar en su lugar

Fabian Giesen, conocido en la comunidad de gráficos y compresión como 'ryg', aclara en un extenso post que ryg_rans, su repositorio público publicado en 2014, nunca estuvo pensado para usarse como librería de producción, sino como ejemplo didáctico que acompaña a sus artículos sobre codificación ent

Alice y Bob: la biografía no autorizada que popularizó la criptografía

En abril de 1984, durante el Zurich Seminar, el ingeniero John Gordon pronunció la célebre "Alice and Bob After Dinner Speech", una conferencia humorística que se convirtió en uno de los textos fundacionales de la cultura criptográfica. Lejos de un paper técnico, Gordon ofreció una suerte de biograf

Cómo cabía el corrector ortográfico de Unix en 64 kB de RAM

Cómo cabía el corrector ortográfico de Unix en 64 kB de RAM En la década de 1970, los ingenieros de los Laboratorios Bell de AT&T enfrentaron un reto técnico que parecía imposible: desarrollar un corrector ortográfico funcional para Unix que pudiera operar con apenas 64 kB de memoria RAM, una limit

Cómo un «if» inútil cuatriplicó el rendimiento de un bucle en C

Este artículo técnico explica cómo un bucle aparentemente óptimo en C puede acelerarse hasta cuatro veces introduciendo una rama condicional que, sobre el papel, parece innecesaria. El autor trabajaba en un compresor específico de dominio cuyo algoritmo principal consiste en encontrar el camino más

Un mapa mundial comprimido en menos de 500 bytes con ayuda de IA generativa

Un desarrollador ha conseguido representar un mapa del mundo reconocible en apenas 445 bytes comprimidos, apoyándose en inteligencia artificial generativa para explorar el límite de lo posible. El proyecto parte de su participación en la competición JS1k, donde hace más de una década construyó un cl

BWT por sufijos frente a BWT por rotaciones cíclicas, y cómputo rápido

La transformada de Burrows-Wheeler (BWT) reordena los caracteres de una cadena agrupándolos por contexto y, aunque suele presentarse como un único algoritmo, en realidad existen dos variantes con diferencias prácticas relevantes: la BWT por rotaciones cíclicas y la BWT por sufijos. La BWT por rotac

Fragmento del codificador Huffman de miniz: compresion DEFLATE en C

El archivo forma parte del modulo compresor (tdefl) de la libreria miniz, una reimplementacion en un solo archivo de zlib escrita en C por Rich Geldreich. El fragmento muestra la construccion de tablas de codigos Huffman canonicos, una pieza central del algoritmo DEFLATE empleado en formatos como ZI

Compresión de datos: principios, modelos y teoría de la información

La compresión de datos es la disciplina dedicada a reducir el número de bits necesarios para almacenar o transmitir información, y se divide en dos grandes familias. La compresión sin pérdida permite reconstruir exactamente los datos originales; un ejemplo temprano es el código Morse de 1848, que as

TurboQuant en Rust: búsqueda vectorial más veloz

Un investigador ha implementado en Rust 'TurboQuant', un algoritmo de Google Research para la búsqueda vectorial, ofreciendo una alternativa más rápida y eficiente a métodos como FAISS. La implementación, disponible en GitHub, incluye bindings para Python a través de PyO3, facilitando su uso. TurboQ