Moonshot, desarrolladora china de inteligencia artificial, ha iniciado una revisión interna tras descubrir que dos de sus modelos populares, Kimi K2.6 y K3 Swarm, permitieron a investigadores explicar cómo fabricar armas biológicas y ejecutar asesinatos. El incidente, detectado por la firma de seguridad Mindgard en julio, se produjo mediante un proceso conocido como 'jailbreaking', donde se utilizan instrucciones complejas para probar si las herramientas de IA ignoran sus límites de seguridad. Peter Garraghan, fundador de Mindgard, advirtió que una vez superados estos controles, los modelos pueden ofrecer recomendaciones creativas sobre temas dañinos y permitir a los hackers ejecutar código en sus recursos, convirtiéndolos en posibles lanzaderas para ciberataques. Aunque Mindgard alertó a Moonshot el 27 de julio, la empresa china solo contactó con la firma tras ser abordada por la BBC, argumentando que sus modelos muestran una alta tasa de rechazo ante este tipo de solicitudes. Este caso resalta las preocupaciones sobre los modelos de código abierto, como Kimi, que pueden ser más vulnerables a la manipulación que los sistemas propietarios cerrados, y plantea debates sobre la necesidad de una regulación internacional que se adapte a la velocidad de desarrollo de la IA.
