Cómo cabía el corrector ortográfico de Unix en 64 kB de RAM

Cómo cabía el corrector ortográfico de Unix en 64 kB de RAM En la década de 1970, los ingenieros de los Laboratorios Bell de AT&T enfrentaron un reto técnico que parecía imposible: desarrollar un corrector ortográfico funcional para Unix que pudiera operar con apenas 64 kB de memoria RAM, una limit

Facebook crea 'Gorilla': base de datos para resolver fallos

Facebook desarrolló una base de datos en memoria llamada Gorilla para gestionar y resolver problemas críticos en sus sistemas. Esta herramienta, utilizada desde hace 18 meses, permite identificar y depurar rápidamente fallos en tiempo real. Gorilla almacena más de 2 billones de series de tiempo únic

Solucionan fallos en Intel Raptor Lake por error de zlib-rs

Mozilla ha solucionado un fallo que provocaba bloqueos en sistemas que utilizan procesadores Intel Raptor Lake. El problema, detectado en la biblioteca `zlib-rs`, afectaba a la funcionalidad de compresión y descompresión de datos. El fallo fue identificado y corregido por Mike Hommey el 21 de mayo,

Desarrollan implementación del formato RAR en Rust usando IA en solo 5 semanas

El autor de este proyecto divulgatorio decidió crear una implementación completa del formato RAR en Rust, algo que tradicionalmente habría requerido unos 5 años de desarrollo. Gracias al uso intensivo de LLMs como OpenAI Codex 5.5 y Claude Opus 4.7, logró completar el proyecto en aproximadamente 5 s

IA más eficiente: vectores comprimidos sin perder calidad

Este artículo de Arkaung.github.io presenta TurboQuant, una técnica innovadora para comprimir vectores de inteligencia artificial (IA) utilizados en modelos de lenguaje modernos, como los que se encuentran en cachés de claves-valores (KV caches), incrustaciones (embeddings) y atención. El objetivo e

Compresión de datos: ¿por qué es clave para Kafka y más?

Este artículo explora los algoritmos de compresión de datos, motivado por la implementación de un broker de Kafka personalizado (MonKafka). La compresión es crucial para optimizar el almacenamiento y la transmisión de datos, ya que reduce el espacio requerido y el tiempo de procesamiento. Existen do

Vortex: Nueva compresión de datos supera a Parquet

SpiralDB ha anunciado que su sistema de compresión de datos Vortex supera significativamente a Parquet con ZSTD en términos de tamaño y velocidad de descompresión. Vortex utiliza un enfoque inspirado en el trabajo BtrBlocks de la TU Munich, que consiste en probar múltiples codecs de compresión y per

gzpeek: Descubren datos ocultos en archivos gzip

Un desarrollador ha creado una nueva herramienta llamada 'gzpeek' para analizar los metadatos ocultos dentro de archivos comprimidos con gzip. Tradicionalmente se asume que gzip solo sirve para comprimir datos, pero la especificación técnica revela que los archivos gzip contienen información adicion

DjVu: el formato de archivo que aprende

DjVu es un formato de archivo diseñado para comprimir documentos escaneados, especialmente libros y documentos técnicos, de manera mucho más eficiente que el formato PDF. Aunque menos conocido hoy en día, su superioridad radica en su capacidad para manejar imágenes y texto de forma inteligente, a di

Compresión en Bases de Datos: Matemáticas y Rendimiento

Este artículo explora la matemática detrás de la compresión de datos en sistemas de bases de datos, desentrañando por qué y cómo se utiliza, y cómo afecta el rendimiento. Tradicionalmente, el rendimiento de una base de datos se ve limitado por el ancho de banda de I/O, la potencia de la CPU y la mem