Un análisis sobre 12.750 artículos de arXiv estima que alrededor de un tercio de los nuevos trabajos científicos presenta un estilo de redacción compatible con texto generado por modelos de lenguaje. El estudio, que abarca de enero de 2023 a julio de 2026 más ocho meses de control de 2021 y 2022, emplea un detector calibrado para escritura académica: a una tasa de falsos positivos del 0,4 %, identifica correctamente el 85 % del texto IA y deja pasar el 99,6 % del texto humano previo a ChatGPT. La muestra incluye diez áreas temáticas, con unos 25 artículos por campo y mes.
Los resultados muestran que la proporción de artículos marcados se mantiene plana en el 0,4 % durante 2021 y 2022, se dispara meses después del lanzamiento de ChatGPT y alcanza aproximadamente el 32 % en el último trimestre completo, con un pico cercano al 39 % a principios de 2026. Informática lidera con un 65 %, seguida de biología cuantitativa (56,3 %), ingeniería eléctrica y de sistemas (51,3 %) y economía y finanzas (47 %). Matemáticas aparece en el extremo opuesto con un 0,7 %, aunque los autores advierten que esa cifra es difícil de interpretar: los artículos matemáticos contienen mayoritariamente notación y demostraciones, y la prosa residual queda fuera de la distribución para la que fue entrenado el detector, por lo que un texto asistido por IA puede no ser detectado.
El trabajo reconoce varias limitaciones: el tamaño de la muestra de control por campo es reducido (200 artículos), la cobertura del detector varía según el modelo de IA utilizado y la herramienta no puede distinguir entre edición asistida y generación completa. Por ello, todas las cifras se interpretan como cota inferior de la prevalencia real. El detector está disponible gratuitamente para comprobar artículos de arXiv o textos propios.
