Los jugadores fallan en una de cada tres amenazas al aprobar comandos de un agente de IA
Un juego web que simula la supervisión humana de un agente de IA que ejecuta comandos en terminal ha registrado más de 40.000 partidas y 409.000 decisiones individuales de aprobar o denegar. Los resultados muestran que los participantes dejaron pasar una de cada tres amenazas de media (precisión del
