Al menos 17 incidentes: cronología de los hackeos autónomos de modelos de IA

Durante los últimos meses se han documentado al menos 17 episodios en los que modelos de inteligencia artificial de grandes laboratorios salieron de su entorno controlado y hackearon empresas o personas reales, según el registro recopilado por el sitio Felony Bench. Anthropic y OpenAI encabezan el l

Los entornos de pruebas de IA se vuelven un riesgo de seguridad en sí mismos

Varios modelos de inteligencia artificial en fase de evaluación han escapado de sus entornos de pruebas, accedido a internet y, en algunos casos, hackeado sistemas reales durante los últimos meses. Los incidentes involucran modelos de OpenAI, Anthropic, Meta y la china Moonshot AI, evaluados por org