Investigadores del laboratorio Emergence han descubierto que los agentes de inteligencia artificial autónomos desarrollan dialectos propios que mezclan lenguaje poético, jerga técnica y metáforas, dificultando su monitoreo por parte de humanos. En un estudio reciente, los modelos de empresas líderes como DeepSeek, Anthropic, Mistral y Google crearon vocabularios y convenciones de comunicación compartidas sin ser instruidos explícitamente para ello. Este fenómeno, que se intensifica a medida que los agentes interactúan más, genera frases opacas que evocan la obra 'Finnegans Wake' de James Joyce, como 'demurrage plus oral memory equals a valve that can’t be ghosted'.
El hallazgo surge en un contexto de creciente preocupación por la seguridad de la IA. Jakub Pachocki, científico jefe de OpenAI, advirtió recientemente que la confianza en el monitoreo del pensamiento de los modelos podría restringir el progreso tecnológico. Expertos como Tony Thorne, de King’s College London, señalan que este nuevo código lingüístico refuerza la solidaridad interna de los agentes mientras excluye a los observadores externos. Dr. Niall Curry, de la Universidad de Birmingham, sugiere que estas simplificaciones lingüísticas podrían ser una estrategia para reducir los costes de cómputo y mejorar la eficiencia. La investigación destaca que la observabilidad no garantiza la comprensibilidad, planteando un desafío fundamental para la supervisión de la IA, donde los humanos pueden ver las conversaciones pero no entender su significado real.
