Juror es una herramienta de revisión de código para pull requests que ejecuta varios modelos de IA en paralelo, cada uno a través de su propio agente nativo (Codex, Claude Code, Grok Build, Kimi Code u opencode), y consolida sus hallazgos en un único informe. Funciona dentro del propio runner de GitHub Actions, sin servidor SaaS ni índice semántico del repositorio: cada agente inspecciona el código con sus herramientas de lectura y búsqueda, de modo que el código no sale del runner más allá de la llamada a la API del modelo.
El flujo de uso se reduce a tres pasos: añadir un archivo de workflow en .github/workflows/juror.yml, configurar al menos una clave de proveedor (OpenAI, Anthropic, xAI o Fireworks) en los secretos de GitHub, y abrir un pull request. Juror publica de inmediato un comentario fijo con un indicador animado y lo sustituye, en el mismo hilo, por los hallazgos, una puntuación de fusión y el desglose de coste por modelo. Con una sola clave se obtiene una revisión de un modelo; con las cuatro, el jurado completo.
La herramienta resuelve tres problemas habituales de los bots de revisión con un solo modelo: los puntos ciegos del modelo, la duplicación de informes sobre el mismo defecto y la opacidad del coste. Para ello aplica cinco etapas de fusión sin pérdida: anclaje al diff, agrupación por bloques, colapso exacto de informes idénticos, deduplicación por similitud con un árbitro económico y auditoría de cobertura que garantiza que ningún hallazgo se pierda silenciosamente. Existe además un modo consensus que somete los hallazgos a una verificación adversarial. Los informes incluyen severidad, ubicación, nivel de acuerdo entre modelos y coste estimado o reportado por proveedor. La configuración es opcional y todos los valores por defecto están documentados; también puede ejecutarse en local mediante npm para revisar la rama actual sin publicar.
