CivBench pone a prueba a los grandes modelos de IA con Civilization VI y solo obtiene tres victorias
Investigadores de la Universidad de Oxford, Google DeepMind y el UK AI Security Institute han presentado CivBench, un benchmark que enfrenta a modelos como GPT-5.4, Claude Opus 4.6, Gemini 3.1 Pro y Kimi K2.5 contra la inteligencia artificial del propio Civilization VI, gestionando simultáneamente e
