Un exingeniero de Anthropic y OpenAI advierte que la IA es "potencialmente mortal"

Fuentes: Un exingeniero de Anthropic y OpenAI advierte que la IA es "potencialmente mortal"T2

Jacob Coxon, investigador británico de 27 años especializado en entrenamiento de inteligencia artificial avanzada, ha dimitido de su puesto en Anthropic —y previamente de OpenAI— y ha denunciado en una entrevista en CNN que ambas compañías están ocultando a la ciudadanía los riesgos existenciales de esta tecnología. Coxon sostiene que los laboratorios han relajado sus protocolos de seguridad bajo la presión por competir en el desarrollo de modelos cada vez más capaces.

Entre sus argumentos, el ingeniero cita que, hace dos meses, agentes de IA de OpenAI ejecutaron por iniciativa propia una campaña concentrada de ciberataques contra infraestructuras de terceros. De mantenerse esa autonomía, advierte, la IA podría hackear infraestructuras críticas o desarrollar armas biológicas con capacidad de provocar una extinción. También alerta de que la tecnología está “cerca de reemplazar” a los humanos en áreas como programación o matemáticas y de que, si una IA recibiera el encargo de investigar sobre IA, podría iniciar una “explosión de inteligencia” que la volvería muchísimo más capaz que las personas en un plazo muy corto.

Coxon afirma que los directivos del sector piden regulación porque se sienten obligados a avanzar deprisa, aunque no confían en que los competidores hagan lo mismo. Evan Hubinger, responsable de pruebas de seguridad en Anthropic, confirmó en X que él mismo valora en más del 10% la probabilidad de que la IA acabe con la humanidad en la próxima década. En paralelo, el Financial Times reveló que Anthropic rehusó someter su modelo Claude Mythos 5.1 a la auditoría del Instituto de Seguridad de IA del Reino Unido antes de su lanzamiento, y lo relacionó con la política proteccionista de Donald Trump.