AgentGuard: eBPF LSM para supervisar agentes de código

Fuentes: AgentGuard: eBPF LSM for coding agents

AgentGuard es un supervisor de seguridad para agentes de código basado en eBPF LSM en Linux, diseñado para garantizar que las políticas de seguridad se cumplan a nivel de kernel, independientemente de las herramientas o métodos que el agente utilice. A diferencia de los guardrails tradicionales que dependen de prompts de sistema, archivos de configuración o hooks de pre-ejecución (considerados una "conciencia" susceptible de ser eludida), AgentGuard opera en la capa del sistema operativo. Su mecanismo central es la denegación de permisos mediante el error EPERM, lo que impide físicamente que el proceso acceda a recursos sensibles o ejecute comandos destructivos, sin importar si se intenta a través de Python, Perl, mmap u otras rutas no estándar.

El proyecto, disponible bajo licencia Apache-2.0 en su versión v0.1.2, define las políticas mediante archivos YAML almacenados en el repositorio del proyecto, permitiendo su revisión y auditoría en las pull requests. Las reglas iniciales bloquean el acceso a credenciales (como .env o id_rsa), comandos destructivos (rm, dd) y el tráfico de red saliente no autorizado, permitiendo solo hosts específicos en el puerto 443. Aunque el sistema funciona de forma autónoma en el kernel, ofrece una integración opcional con hooks de herramientas como Claude Code o Codex para inyectar mensajes de retroalimentación al modelo, facilitando su adaptación ante los bloqueos. AgentGuard no reemplaza las sandboxes de los proveedores ni funciona en macOS (que carece de BPF LSM), pero ofrece una capa de seguridad auditable y agnóstica al agente para entornos Linux controlados, asegurando que la "puerta" del sistema permanezca cerrada incluso si la "conciencia" del agente falla.