Ingeniería de contexto para agentes de código: por qué más bucles no bastan

Fuentes: Advanced Context Engineering for Coding Agents: Harness Engineering Is Not Enough

El autor, fundador de HumanLayer, sostiene que la promesa de producir software de calidad a 10-100x más rápido sin revisión humana mediante ingeniería de bucles (harness engineering) y más tokens no se sostiene: se trata, en el fondo, de un problema de entrenamiento de los modelos. Para argumentarlo, repasa la evolución de las fábricas de software desde la conferencia de la OTAN de 1968 —la misma que acuñó "ingeniería de software"— hasta los flujos de Linear, pull requests, CI y monitorización tal como se entendían en 2022, antes de la irrupción de la IA. Sobre esa base, discute por qué los modelos pueden generar grandes volúmenes de código de baja calidad aun rindiendo bien en benchmarks, incluidos los "fronterizos" recientes, y por qué la aceleración indiscriminada ya muestra señales de alarma: un informe de Faros AI detecta, desde la adopción masiva de herramientas de IA a principios de 2025, más comentarios en pull requests, PRs fusionados sin revisión, más incidencias y más bugs por desarrollador. El texto también recoge los avisos de Mario y Matt Pocock sobre apagones provocados por agentes de código y codebases que se degradan a gran velocidad. Frente al lema "solo gasta más tokens", la pieza defiende trabajar con criterio sobre el contexto en codebases complejos (brownfield), donde un repositorio construido con agentes puede empezar a deteriorarse en tres a seis meses, y propone criterios generales —no atados a ningún plugin ni framework— para avanzar rápido sin incendiar la base de código. El artículo es la versión escrita y ampliada de la keynote del autor en AI Engineer World's Fair 2026.