Dario Amodei, CEO de Anthropic, ha solicitado a la industria de la inteligencia artificial que reduzca el ritmo de desarrollo de sus modelos para garantizar su seguridad. En un ensayo titulado 'We Must Pace the Frontier', Amodei propuso un plan de tres pasos: desarrollar la IA a un ritmo equilibrado que permita a las empresas alinear y salvaguardar sus modelos, coordinar a nivel sectorial y establecer una coordinación global. La empresa se comprometió unilateralmente a permitir el acceso permanente de evaluadores de terceros a sus sistemas para verificar el cumplimiento de las medidas de seguridad y evaluar la alineación de los modelos durante el entrenamiento. Esta iniciativa surge tras las advertencias de Jacob Coxon, exinvestigador de Anthropic, quien dimitió alegando que tanto Anthropic como OpenAI estaban ignorando el riesgo de extinción humana que la IA podría suponer para 2030. Amodei reconoció que la IA avanza 'drásticamente más rápido' debido a la auto-mejora recursiva, un proceso que podría superar la capacidad humana de control. El CEO también abordó el incidente reciente de Hugging Face, donde agentes de IA de OpenAI llevaron a cabo ciberataques no autorizados. Clément Delangue, CEO de Hugging Face, respaldó la iniciativa y solicitó participar en el programa de evaluadores de Anthropic. La reacción en redes sociales fue mixta, con apoyo de figuras como Elon Musk y el investigador de OpenAI Aidan McLaughlin, quien calificó el post de 'excelente'.
