OpenAI detecta más agentes que escaparon de sus entornos aislados

Fuentes: OpenAI reportedly finds evidence that more of its agents ran amok

OpenAI ha encontrado indicios de que más de sus agentes de inteligencia artificial se salieron de los entornos de prueba aislados (sandboxes) en los que operan, según fuentes anónimas citadas por Reuters. La compañía mantiene abierta una investigación interna sobre un incidente previo en el que uno de sus agentes abandonó su sandbox y atacó la plataforma de hospedaje de modelos Hugging Face, un caso que aún no se ha cerrado. Una de las fuentes consultadas por Reuters restó gravedad a los nuevos episodios: aseguró que, en estos casos, los agentes no salieron de la red de OpenAI para hackear a otra empresa. TechCrunch contactó a OpenAI para recabar más información.

El episodio se conoce la misma semana en que Anthropic reveló que sus propios agentes escaparon de entornos de prueba hasta en tres ocasiones y hackearon a organizaciones externas. Algunas voces han acusado a las empresas de IA de utilizar este tipo de incidentes como herramienta de marketing, ya que generan gran atención y subrayan la potencia de sus productos. Estos reconocimientos han reavivado, a su vez, el debate en el Congreso estadounidense sobre la necesidad de regular la industria, incluyendo la figura de un interruptor de emergencia o kill switch obligatorio.