Guía para ejecutar modelos LLM locales en Mac mini M4 Pro

Ejecutar servidores de modelos de lenguaje grandes (LLM) localmente en hardware de consumo, como el Mac mini con chip M4 Pro y 48 GB de RAM, ofrece una alternativa viable a las APIs en la nube. Esta configuración permite gestionar agentes de IA y consultas rutinarias sin depender de suscripciones ex

La memoria de los agentes debe ser determinista y vivir en el edge

Las arquitecturas de agentes basadas en LLM suelen delegar en el modelo la gestión de su propia memoria: el agente relee textos antiguos para decidir si un dato es nuevo o corrige uno previo, si dos instrucciones se contradicen o si una preferencia ha cambiado. El autor, con experiencia en infraestr

Vomit, una herramienta local para reinterpretar la salida de Claude

Vomit es una utilidad de línea de comandos escrita en Go y distribuida bajo licencia GNU GPLv3 que actúa como intermediario entre el asistente Claude, de Anthropic, y un modelo de lenguaje local. Su propósito declarado es convertir la salida textual del asistente en una versión más breve y clara med

Una crítica técnica a OpenCode: fallos de caché y diseño del prompt

Un análisis extenso y crítico del agente de programación OpenCode, la herramienta de código abierto de este tipo más popular en GitHub con 161.000 estrellas. El autor distingue entre problemas molestos —fallos repetidos de caché de prompt al reevaluar el prompt del sistema en cada turno SSE, al poda

Cómo autoalojar un servidor de correo en 2026 sin caer en el spam

Christian Haschek desmonta el mito de que autoalojar un servidor de correo sea inviable y propone una guía práctica basada en su propia experiencia migrando desde Google Workspace. El texto es un artículo didáctico que recorre las decisiones clave: alojamiento en casa frente a VPS (con requisitos co

Qwen 3.6 27B: el modelo local que cambia las reglas del juego

Qwen 3.6 27B se ha convertido en una de las opciones más atractivas para ejecutar modelos de lenguaje de gran tamaño en hardware propio. Se trata de un modelo denso de 27.000 millones de parámetros —acompañado por una variante MoE de 35B A3B más rápida pero menos precisa— que, según benchmarks indep

Ejecutar modelos de IA en local ya es una opción viable

Ejecutar modelos de lenguaje en el propio ordenador ha dejado de ser una tarea marginal y se ha convertido en una alternativa práctica para tareas de desarrollo. Una ingeniera con un Mac M2 de 2022 (64 GB de RAM y 1 TB de almacenamiento) describe cómo ha pasado de depender de servicios en la nube a

Puse una GPU de datacenter en mi PC gaming por £200

Un usuario logró duplicar la memoria VRAM de su ordenador de juegos añadiendo una GPU de datacenter Tesla V100 SXM2 por un coste total de unas 200 libras. La necesidad surgió al querer ejecutar localmente modelos de lenguaje grandes (LLM) que requerían más de los 16 GB de su RTX 4080. La solución fu

agenticSeek: IA privada que funciona en tu dispositivo

Un nuevo asistente de IA de código abierto llamado agenticSeek ha sido lanzado en GitHub, ofreciendo una alternativa centrada en la privacidad a las soluciones basadas en la nube como Manus AI. Este asistente funciona completamente en el dispositivo del usuario, sin necesidad de conexión a internet