OpenAI presenta ChatGPT Images 2.5 con mayor detalle, edición más precisa y un 50% menos de latencia

Fuentes: Introducing ChatGPT Images 2.5 with sharper details, faster generation, and more precise editing, theverge.com, 20minutos.esT3clickbait

OpenAI presentó este martes ChatGPT Images 2.5, la nueva versión de su modelo de generación de imágenes que promete mayor detalle visual, edición más precisa y una reducción de hasta el 50% en la latencia de generación respecto a su predecesor, Images 2.0. El anuncio, realizado a través del blog oficial de la compañía, coincide con un momento en el que los usuarios crean más de 3.000 millones de imágenes cada semana entre ChatGPT Images y los modelos GPT-Image disponibles en la API, según datos difundidos por la propia empresa.

El modelo incorpora mejoras sustanciales en la calidad de salida. Según OpenAI, Images 2.5 produce una iluminación más natural y texturas más ricas, además de preservar mejor los sujetos presentes en las fotografías de referencia que los usuarios aportan como guía. La compañía asegura que el sistema sigue las instrucciones de edición de forma más fiable, incluso a lo largo de múltiples turnos de conversación, lo que evita la degradación progresiva de la calidad cuando se realizan ajustes sucesivos sobre el mismo material.

Junto al modelo, OpenAI introdujo varias funciones nuevas en ChatGPT orientadas a ampliar el control creativo. La más destacada es Sketch, una herramienta que permite dibujar directamente dentro de la interfaz de ChatGPT para usar el boceto como referencia visual. Tal como recogió The Verge en su cobertura del anuncio, los usuarios pueden realizar un garabato —el diseño de una habitación, el contorno de un atuendo o cualquier otra idea rápida— y dejar que el sistema lo transforme en una imagen completa, añadiendo una descripción de estilo y otros detalles. Para activarlo, basta con escribir "@Sketch" en el chat.

Otra de las novedades son las plantillas prediseñadas para formatos populares como carteles ("Poster") o productos de merchandising ("Merch"), que permiten partir de una estructura predefinida en lugar de un lienzo en blanco. Además, ahora se pueden colocar comentarios directamente sobre las imágenes para guiar ediciones más focalizadas, y es posible compartir los prompts junto con las imágenes generadas, lo que facilita que otros usuarios repliquen una idea con sus propias fotografías y variaciones.

En el plano técnico, Images 2.5 mejora la comprensión de instrucciones visuales complejas, incluyendo la representación de información del mundo real y la gestión de diseños elaborados con fondos transparentes. La compañía destaca que el modelo refleja con mayor fidelidad los estilos visuales solicitados, reduciendo las desviaciones no deseadas respecto a la intención original del usuario. Este aspecto resulta especialmente relevante para desarrolladores y equipos creativos que necesitan mantener una dirección visual coherente en series de activos, conceptos de interfaz o presentaciones corporativas.

Para los desarrolladores que utilizan la API de imágenes, OpenAI lanzó dos variantes del nuevo modelo. GPT-Image-2.5 Flare es la opción por defecto, orientada a la mayoría de aplicaciones: ofrece mayor calidad que GPT-Image-2 con un 50% menos de latencia, según la empresa, y resulta adecuada para contenido de redes sociales, experiencias de producto, búsqueda visual y generación de alto volumen. Por su parte, GPT-Image-2.5 Sunburst está diseñado para flujos de trabajo premium que requieren un control más estricto en las ediciones, como creatividades publicitarias listas para producción o imágenes de producto pulidas, aunque a costa de tiempos de generación más largos.

La compañía enmarcó el lanzamiento en su estrategia de construir herramientas de generación de imágenes que sean "útiles, creativas y seguras". Images 2.5 incorpora verificaciones sobre prompts e imágenes para prevenir resultados dañinos, y mantiene el uso de metadatos C2PA y marcas de agua invisibles como mecanismos de trazabilidad del origen de las imágenes generadas. OpenAI remitió a su system card para ampliar detalles sobre las evaluaciones de seguridad realizadas.

Images 2.5 está disponible desde el mismo día del anuncio para todos los usuarios de ChatGPT, ChatGPT Work y Codex, en cualquier nivel de suscripción, a través de escritorio, dispositivos móviles y la versión web. Los modelos GPT-Image-2.5 Flare y Sunburst ya están operativos en la API, con información de precios publicada en la web de OpenAI.

El lanzamiento llega en un contexto de competencia creciente en el segmento de generación de imágenes mediante inteligencia artificial, donde rivales como Midjourney, Stability AI y los modelos Imagen de Google han elevado sucesivamente el estándar de calidad y control. La apuesta de OpenAI por integrar el dibujo a mano alzada como vía de entrada creativa, sumada a la reducción de latencia y a las mejoras de coherencia en ediciones múltiples, apunta a consolidar su posición tanto en el segmento de consumo como en el uso profesional y empresarial, donde la fiabilidad en flujos de trabajo repetitivos resulta determinante.