Many popular projects use Arrow to ship columnar data efficiently or as the basis for analytic engines.

Noticias que mencionan Apache Arrow

Hardwood acelera la lectura de listas de longitud fija en Parquet

Hardwood, un lector de Parquet en Java, incorpora una ruta rápida para listas de longitud fija que evita el costoso mecanismo de reconstrucción de registros Dremel cuando todas las listas de una página tienen el mismo tamaño. La técnica detecta, examinando las secuencias de niveles de definición y r

Arquitecturas sin rdb en kdb+: una alternativa simplificada y escalable

Matt Doherty, desarrollador de kdb+, cuestiona un pilar clásico de esta tecnología: el uso de bases de datos en tiempo real (rdbs) como componente por defecto. Propone una arquitectura alternativa en la que todos los datos se escriben directamente a disco mediante procesos writer y se consultan a tr

Polar Signals migra su dashboard de flame graphs de SVG a Canvas

Polar Signals ha rediseñado el panel de su profiler sustituyendo el renderizado basado en SVG por un motor de Canvas, con el objetivo de eliminar el cuello de botella que imponía el árbol DOM al dibujar flame graphs con decenas de miles de frames. En el modelo previo, cada frame se representaba como

databow: una CLI en Rust para consultar cualquier base de datos con ADBC

databow es una nueva herramienta de línea de comandos de código abierto, escrita en Rust, que ofrece una interfaz unificada para consultar cualquier base de datos que disponga de un driver ADBC (Arrow Database Connectivity). Su propósito es sustituir el uso de múltiples clientes CLI específicos —psq

Apache Arrow: 10 años de intercambio de datos

El proyecto Apache Arrow celebra su décimo aniversario el 5 de febrero de 2026. Iniciado en 2016 como un esfuerzo conjunto para estandarizar el intercambio eficiente de datos columnares entre diferentes bibliotecas y sistemas, Arrow complementa a Apache Parquet al proporcionar un formato en memoria.