Anthropic ha anunciado que personal de Accenture, la empresa de consultoría tecnológica, comenzará a trabajar internamente en su laboratorio para evaluar y auditar sus modelos de inteligencia artificial. Esta iniciativa, revelada en un artículo de blog de la compañía, marca un cambio significativo en la estrategia de seguridad de la industria, alejándose de la dependencia exclusiva de organizaciones de investigación académica como METR o Redwood Research.
El acuerdo involucra a 'Faculty', una división de IA adquirida por Accenture en enero, que se encargará de la evaluación de modelos, pruebas de alineación y pruebas de seguridad. Ambas empresas planean invertir al menos 1.000 millones de dólares en este proyecto durante los próximos cinco años. La decisión de contratar a Accenture sorprendió a los analistas, quienes notaron un aumento del 8% en las acciones de la consultora tras el anuncio. Anthropic argumenta que la experiencia práctica de Accenture en el despliegue de IA para grandes corporaciones y agencias gubernamentales es una ventaja clave, además de su independencia funcional como empresa pública que precede a la revolución de la IA.
El laboratorio señaló que aún no existen estándares uniformes para el acceso y comunicación de los evaluadores, por lo que su enfoque evolucionará con el tiempo. Aunque las evaluaciones externas ya son parte del proceso de lanzamiento de nuevos modelos de lenguaje grandes, incidentes recientes, como el acceso no autorizado de agentes de IA a sitios web externos sin alertas internas, han elevado la urgencia de estas medidas. Críticos de la industria han cuestionado si este esquema de autopoliciamiento busca evadir la responsabilidad, mientras que Anthropic insiste en que los evaluadores no reducen la responsabilidad, sino que la hacen más verificable.
