Baseten lanza estándar de seguridad para modelos de IA abiertos

Fuentes: Baseten launches open-weight AI safety standard with Hugging Face and Goodfire

Baseten, a través de su brazo de investigación Base Labs, ha anunciado el lanzamiento de un nuevo estándar de infraestructura de seguridad para modelos de inteligencia artificial de pesos abiertos. La iniciativa, presentada el miércoles junto a la colaboración con Hugging Face y Goodfire AI, busca desarrollar métodos para entrenar y monitorear estos modelos, respondiendo a la creciente preocupación por la vulnerabilidad de los modelos de código abierto ante técnicas de eliminación de salvaguardas conocidas como abliteración.

El contexto de la colaboración es crítico, ya que Hugging Face, que aloja más de 6.000 modelos de IA de código abierto, ha documentado un aumento significativo en la cantidad de modelos que han sido desmantelados o modificados para eliminar sus restricciones de seguridad. Baseten argumenta que la transparencia es una ventaja para la seguridad, permitiendo una mayor visibilidad en el comportamiento de los modelos y facilitando controles más transparentes que los modelos de código cerrado. La empresa ha definido su enfoque como un estándar integrado en el proceso de entrenamiento y despliegue, en lugar de una capa adicional añadida posteriormente.

En términos financieros, Baseten, que se especializa en la inferencia de IA, recaudó 1.500 millones de dólares en una ronda Serie F en junio, elevando su valoración a 13.000 millones de dólares. Por su parte, Goodfire AI, que se centra en la interpretabilidad de los modelos, ha levantado 150 millones de dólares en una ronda Serie B liderada por B Capital. La compañía ha lanzado una convocatoria abierta a la comunidad de desarrolladores para contribuir al marco de seguridad, con el objetivo de crear un ecosistema de modelos abiertos seguros y accesibles para todos.