Noticias que mencionan Clickhouse

Guía técnica para instalar y configurar Strata localmente

Strata es una herramienta de modelado de datos que permite ejecutar análisis semánticos y visualización de datos directamente en el equipo del usuario, eliminando la dependencia de la nube. El sistema opera mediante un servidor local que se instala en Docker, requiriendo Ruby 3.4.4 o superior, Git y

QueryBrew optimiza consultas SQL mediante reescritura agnóstica de sistemas

QueryBrew es un servicio de optimización de consultas SQL diseñado para desacoplar el optimizador del motor de base de datos mediante reescritura SQL-to-SQL. Desarrollado por investigadores de la Technische Universität München, esta herramienta permite que cualquier sistema de base de datos relacion

Hacker News: Houthi controlan isla clave y Matt Mullenweg recupera el mando

La portada de Hacker News destaca una serie de acontecimientos de actualidad tecnológica y geopolítica. En el ámbito de la seguridad informática, un artículo de derflounder detalla que la copia manual de keychains de inicio de sesión entre Macs falla en equipos con Secure Enclave que ejecutan macOS

Lecciones de cinco años operando clústeres ClickHouse a escala petabyte

Un ingeniero de Tinybird comparte su experiencia de cinco años operando clústeres de ClickHouse a escala petabyte, destacando que la configuración inicial es sencilla, pero el mantenimiento a largo plazo presenta desafíos significativos. El artículo analiza la arquitectura tradicional basada en répl

De 85 segundos a milisegundos: optimización de consultas en ClickHouse

Un equipo técnico detalla las optimizaciones aplicadas durante cuatro meses para reducir el tiempo de una consulta crítica de ClickHouse desde 85,7 segundos hasta milisegundos, en un caso real de producción. El escenario parte de una tabla de eventos que alimentan la pantalla principal de un panel d

AC2: plataforma para evaluar, entrenar y desplegar agentes de IA

AC2 es una plataforma integral orientada al ciclo de vida de agentes de inteligencia artificial, desde la evaluación hasta el entrenamiento y el despliegue en producción. Se compone de tres paquetes principales: ac2.sdk, un cliente en Python para gestionar datasets, cargas de trabajo, sesiones, traz

Jerarquía de claves para la seguridad a nivel de rack en Oxide

Este documento técnico de Oxide describe la estrategia de jerarquía de claves diseñada para proteger los datos en reposo dentro de un rack de computación. El sistema parte de un Secreto de Rack compartido, reconstruido mediante compartición de secretos de Shamir a partir de K de N partes distribuida

Observal, un registro local para gestionar componentes internos de IA

Observal es una plataforma de código abierto bajo licencia Apache-2.0 que actúa como plano de control y registro centralizado para los componentes de inteligencia artificial que las organizaciones desarrollan internamente, como skills, agentes y servidores MCP. Su objetivo es resolver dos problemas

Cómo Helicone aísla a sus clientes al permitir SQL directo sobre ClickHouse

Helicone, plataforma de observabilidad para aplicaciones de IA, incorporó un editor SQL llamado HQL que permite a los clientes ejecutar consultas SELECT directamente contra su clúster compartido de ClickHouse. Como todos los datos de tenants conviven en una misma tabla diferenciados por organization

Por qué ClickHouse se está imponiendo en la guerra de la observabilidad

Gestionar logs a escala es una de las tareas más ingratas de la ingeniería de software, y quien lo ha padecido durante una década lo sabe de primera mano. Este artículo técnico y opinativo recorre el problema de fondo: los desarrolladores esperan búsquedas instantáneas y consultas improvisadas, mien

QuestDB hace WINDOW JOIN paralelo y vectorizado con SIMD

QuestDB ha reescrito su operador WINDOW JOIN para que se ejecute en paralelo a nivel de datos y aproveche instrucciones SIMD en la agregación interna. La nueva ruta emplea dos piezas: paralelización por page frames sobre la tabla izquierda (LHS), y una vía rápida para claves de baja cardinalidad que

PostHog reescribe su parser de SQL con IA y multiplica por 70 su velocidad

PostHog ha sustituido el parser SQL que usaba como base de toda su plataforma de consultas por una implementación escrita de forma manual asistida por Claude Code, logrando una aceleración aproximada de 70 veces en la conversión de SQL a ClickHouse. La necesidad de un parser propio nace del modelo

Akvorado escala su RIB de BMP mediante particionamiento (sharding)

Akvorado, la herramienta de monitorización de redes que enriquece flujos con información de encaminamiento BGP mediante el protocolo BMP, necesitaba escalar su base de datos de rutas (RIB) para soportar decenas de millones de entradas, dado que la tabla de encaminamiento de Internet supera el millón

Diez años de ClickHouse como proyecto de código abierto

ClickHouse cumple una década desde su liberación como software de código abierto el 15 de junio de 2016 y se ha consolidado como la base de datos analítica open source más popular, con más de 2.000 contribuidores. Este artículo repasa la filosofía de desarrollo abierto del proyecto y su evolución té

Claw Patrol: un firewall de seguridad para agentes de IA

Claw Patrol es un firewall de seguridad diseñado específicamente para agentes de inteligencia artificial. Desarrollado por Deno Land (denoland), se sitúa entre los agentes y los entornos de producción, inspeccionando el tráfico a nivel de cable y evaluando cada acción contra un conjunto de reglas es

Lecciones de orquestar 100.000 sandboxes concurrentes

Scale, una empresa de evaluación de infraestructura en la nube, pospuso la publicación de los resultados de su "Scale Invitational" del 8 al 17 de junio tras descubrir, durante el diseño de la prueba, problemas de fondo que invalidaban sus primeras mediciones. El benchmark busca comparar proveedores

databow: una CLI en Rust para consultar cualquier base de datos con ADBC

databow es una nueva herramienta de línea de comandos de código abierto, escrita en Rust, que ofrece una interfaz unificada para consultar cualquier base de datos que disponga de un driver ADBC (Arrow Database Connectivity). Su propósito es sustituir el uso de múltiples clientes CLI específicos —psq

Athena: herramienta CDC en Go para replicar cambios de SQL Server en Kafka

Athena es una herramienta ligera de captura de datos cambiados (CDC) escrita en Golang que replica en tiempo real las modificaciones realizadas en bases de datos Microsoft SQL Server hacia topics de Apache Kafka. Su objetivo principal es simplificar un proceso que, con alternativas consolidadas como

Kaelio lanza ktx para optimizar la consulta de datos por agentes de IA

Kaelio ha lanzado ktx, una herramienta de código abierto disponible en GitHub, diseñada para optimizar la consulta de datos por parte de agentes de inteligencia artificial. Esta herramienta actúa como una capa de contexto automejorante que facilita la interacción de los agentes con los almacenes de

Kanjideck: Fallo por falta de espacio en disco

Un servidor dedicado a la distribución de archivos digitales para clientes de Kanjideck sufrió una interrupción la noche del 31 de marzo debido a un rápido agotamiento del espacio en disco. El servidor, alojado en Hetzner con 4GB de RAM y 40GB de disco, se vio abrumado por una gran cantidad de usuar

PostHog contrata y anuncia 20 nuevos productos

La empresa de análisis de productos PostHog está buscando activamente talento en roles técnicos especializados, incluyendo ingenieros de producto (con experiencia en IA), ingenieros de ClickHouse, ingenieros de backend, product managers, investigadores de IA y personal de soporte técnico y cuentas.

Gran repositorio de blogs sobre tecnologías clave en GitHub

Un desarrollador, OneUptime, ha añadido una extensa colección de 12.000 artículos de blog a un repositorio de GitHub, cubriendo una amplia gama de tecnologías clave. Los temas incluyen ClickHouse (una base de datos analítica de columnas), Redis (un almacén de datos en memoria), MongoDB, MySQL, Rook/

Stripe simplifica el análisis con nuevas líneas de registro

Stripe ha introducido un nuevo sistema de registro llamado 'líneas de registro canónicas' (o eventos amplios) para mejorar la depuración y el análisis de sus sistemas. El problema que busca solucionar es la fragmentación de la información de registro, donde detalles cruciales como la ruta, el usuari

Base de datos resiliente: el contexto es clave

El artículo aborda una pregunta común en entrevistas técnicas: "Diseña una base de datos altamente resiliente". El autor relata una experiencia negativa en una entrevista donde, al no recibir contexto sobre el sistema, propuso una solución compleja (CloudNativePG en Kubernetes con respaldo en S3) qu

Converge: Startup de datos levanta $5.7M

La startup Converge, una plataforma de datos para marcas de consumo, ha recaudado 5.7 millones de dólares en financiación liderada por Y Combinator y General Catalyst, entre otros inversores. La plataforma ayuda a más de 200 marcas, incluyendo empresas que cotizan en bolsa, a analizar su rendimiento

Rudel: Análisis Detallado para Usuarios de Claude Code

Un nuevo software llamado Rudel ha sido lanzado para proporcionar análisis detallados de las sesiones de codificación realizadas con Claude Code, el modelo de Anthropic. La herramienta, disponible gratuitamente en rudel.ai, ofrece un panel de control con información sobre el uso de tokens, duración

Firetiger facilita acceso seguro a bases de datos privadas

Firetiger ha anunciado la introducción de 'Network Transports', una nueva funcionalidad que permite a sus agentes conectarse de forma segura a bases de datos Postgres, MySQL y Clickhouse que residen en redes privadas. Anteriormente, la imposibilidad de acceder a estas bases de datos, comúnmente ubic