La memoria de los agentes debe ser determinista y vivir en el edge

Las arquitecturas de agentes basadas en LLM suelen delegar en el modelo la gestión de su propia memoria: el agente relee textos antiguos para decidir si un dato es nuevo o corrige uno previo, si dos instrucciones se contradicen o si una preferencia ha cambiado. El autor, con experiencia en infraestr

SQLite en producción: cómo ajustar WAL, concurrencia y VFS para baja latencia

SQLite, concebido históricamente como base de datos embebida para móviles, IoT o entornos de desarrollo, puede comportarse como un motor de producción de alto rendimiento si se ajusta de forma adecuada. El artículo desgrana los cuatro ejes clave de esa optimización: el modo Write-Ahead Logging (WAL)

Pequeños modelos de IA llevan salud a zonas sin infraestructura digital

Los grandes modelos de lenguaje dominan el debate sobre inteligencia artificial, pero en buena parte del planeta la única IA disponible —y la más útil— es la pequeña: modelos de pocos miles de millones de parámetros que funcionan directamente sobre teléfonos, placas Arduino o drones, con pocos vatio

Cloudflare lanza Workers Cache, una caché nativa delante de cada Worker

Cloudflare ha presentado Workers Cache, una capa de caché en niveles que se sitúa delante de los Workers y se activa con una sola línea en la configuración de Wrangler. Cuando está habilitada, cada solicitud cacheable se atiende directamente desde la caché de Cloudflare sin ejecutar el Worker ni con

Wasmer: aplicaciones universales mediante WebAssembly

Wasmer es una plataforma de ejecución de aplicaciones basada en WebAssembly (Wasm) que permite desplegar software de forma segura y portable en servidores, navegadores, dispositivos móviles y entornos embebidos. Su propuesta se centra en ofrecer tiempos de arranque inferiores al milisegundo, una alt

Cloudflare tarda seis semanas en encontrar un error en la biblioteca HTTP hyper

Cloudflare ha detallado la investigación que llevó a detectar y corregir un error en la biblioteca HTTP de Rust hyper, utilizada por su servicio de Images sobre Workers. El fallo, una condición de carrera, se manifestaba solo de forma intermitente en imágenes grandes: la respuesta devolvía un código

¿Necesitamos un nuevo sistema de build para Linux embebido?

Tras dos décadas construyendo productos con Linux embebido, el autor plantea que los sistemas de build clásicos —Buildroot y, sobre todo, Yocto/OpenEmbedded— ya no encajan con la realidad actual de los dispositivos de borde. Estos sistemas nacieron cuando los ARM eran lentos y solo tenía sentido com

Google acelera en IA para competir con Amazon y Microsoft

Google está intensificando su apuesta por la inteligencia artificial (IA) en el borde (edge computing) como estrategia para recuperar terreno frente a sus rivales, Amazon y Microsoft, en el mercado de la computación en la nube. La compañía busca aprovechar su liderazgo en IA para ofrecer servicios m

IA para todos: superando costos y lentitud

El artículo de taalas.com aborda un desafío crucial para la adopción generalizada de la Inteligencia Artificial (IA): la combinación de alta latencia y costos prohibitivos. Actualmente, los modelos de IA, especialmente los grandes modelos de lenguaje (LLM), requieren una infraestructura masiva y cos

GPT en C: modelo más rápido para dispositivos

Un desarrollador ha creado una implementación en lenguaje C99 de un modelo GPT de estilo 'character-level', denominado MicroGPT-C, que permite un entrenamiento y generación de texto significativamente más rápidos que las implementaciones en Python. El proyecto, publicado en GitHub, busca ofrecer una