Un proyecto de código abierto alojado en GitHub, denominado watermarks-remover, está diseñado para eliminar distintos tipos de marcas de agua presentes en textos y archivos generados por inteligencia artificial. La herramienta opera con caracteres Unicode invisibles, marcas estadísticas en texto y metadatos incrustados en formatos como PNG, JPEG, SVG, PDF, DOCX, ODT, HTML y Markdown.
Su arquitectura se divide en capas especializadas: una detecta señales relacionadas con la edición del contenido, como caracteres Unicode poco habituales; otra analiza patrones estadísticos propios de los textos generados por IA, y una tercera elimina información de procedencia y metadatos, incluyendo los estándares C2PA, EXIF y XMP.
La versión 0.3.1 ha reforzado la función de reescritura de texto. La herramienta ya no se limita a sustituir palabras aisladas: modifica la estructura de las frases, la elección de términos, las transiciones entre ideas y otros patrones lingüísticos con el fin de dificultar la detección de marcas estadísticas. Sus responsables reconocen que una reescritura intensa puede alterar el tono, el estilo e incluso la precisión del contenido original.
El propio proyecto admite limitaciones importantes: no garantiza burlar los mecanismos de detección de un proveedor concreto y algunas señales pueden sobrevivir al proceso de limpieza, ya que cada compañía aplica tecnologías distintas. Los impulsores defienden que la iniciativa está orientada a la privacidad y la investigación, y no a presentar deliberadamente contenido generado por IA como si fuera humano.
