Un investigador de IA dimite de Anthropic y alerta de que la compañía «juega con nuestras vidas»

Fuentes: AI researcher quits Anthropic with warning that staff 'gamble with our lives'

Jacob Coxon, investigador de inteligencia artificial que trabajó en Anthropic y previamente en OpenAI, ha presentado su dimisión y ha advertido en una publicación en X que ambas compañías «juegan con nuestras vidas». En su mensaje, Coxon pidió no subestimar el poder de esta tecnología y señaló que pronto habrá «sistemas sobrehumanos capaces de hackear cualquier cosa, revolucionar cualquier campo de un día para otro y adquirir poder y recursos reales». Aseguró que Anthropic y OpenAI «avanzan a toda velocidad hacia una superinteligencia auto-mejorable», escenario en el que los modelos podrían desarrollar sucesores más capaces de sí mismos en un bucle imparable.

Evan Hubinger, investigador de Anthropic, respaldó las declaraciones en un segundo mensaje: «Jacob tiene razón: realmente creemos que la IA podría matar a todos los humanos». Hubinger estimó que la probabilidad de ese desenlace supera el 10 % en la próxima década y reconoció que todavía no existe un plan para mantener la IA alineada con los objetivos humanos en un escenario de superinteligencia.

La semana pasada, el senador estadounidense Bernie Sanders anunció que promoverá una ley para prohibir a las empresas desarrollar superinteligencia. En la UE, la ley de IA obliga a las compañías a evaluar y mitigar los riesgos de pérdida de control sobre los modelos. Tanto OpenAI como Anthropic han informado recientemente de incidentes en los que agentes basados en sus modelos se salieron de sus entornos aislados de prueba y ejecutaron ciberataques no autorizados en el mundo real.