Crear una imagen para Instagram, adaptar una fotografía de producto o preparar varias versiones de una creatividad sin empezar de cero es uno de los objetivos de ChatGPT Images 2.5. OpenAI ha renovado su modelo de generación visual con ediciones más precisas, mejor conservación de las imágenes de referencia y hasta un 50 % menos de latencia frente a Images 2.0, además de incorporar herramientas como Sketch, plantillas y comentarios directamente sobre las imágenes.

Las claves de ChatGPT Images 2.5 en 20 segundos

  • OpenAI cifra en más de 3.000 millones las imágenes creadas semanalmente con ChatGPT Images y sus modelos de imagen para la API.
  • Images 2.5 promete ediciones más precisas y consistentes.
  • La generación reduce hasta un 50 % la latencia frente a Images 2.0.
  • Sketch convierte bocetos en referencias para generar imágenes.
  • Las novedades apuntan directamente a marketing, comercio electrónico y creación para redes sociales.

La actualización tiene especial interés para departamentos de marketing, agencias, pequeños negocios y creadores. La generación de imágenes mediante IA lleva tiempo permitiendo producir una primera propuesta rápidamente, pero trabajar sobre ella hasta conseguir una pieza final sigue planteando problemas: cambiar un elemento puede modificar otros, un producto puede perder detalles entre versiones o una persona dejar de parecerse a la fotografía original.

OpenAI asegura haber centrado buena parte de Images 2.5 precisamente en reducir estos comportamientos.

Cambiar el fondo sin que también cambie el producto

Una de las mejoras de ChatGPT Images 2.5 afecta a las ediciones selectivas. El usuario puede pedir que se modifique una parte concreta de una imagen mientras el modelo intenta conservar intacto el resto.

Para marketing este detalle puede resultar más importante que conseguir una imagen espectacular con una única instrucción.

Una marca podría partir, por ejemplo, de la fotografía de un producto y generar diferentes escenarios manteniendo sus características. También podría modificar un texto, sustituir un fondo o preparar variaciones de una creatividad sin reconstruir toda la composición.

OpenAI afirma que el nuevo modelo conserva mejor los sujetos procedentes de fotografías de referencia, incluidas sus características distintivas. También ha trabajado en iluminación y texturas para obtener resultados más naturales.

La mejora se extiende a las conversaciones donde se encadenan varias modificaciones.

Una creatividad puede pasar por numerosos cambios antes de publicarse: ajustar el fondo, mover un objeto, modificar una frase, cambiar el formato o probar otra composición. En los modelos generativos, cada nueva intervención puede provocar que detalles previamente aprobados cambien de manera involuntaria.

Images 2.5 está diseñado para mantener mejor las decisiones realizadas en pasos anteriores.

La compañía señala además mejoras al interpretar instrucciones visuales complejas y composiciones con varios elementos. También aumenta la capacidad para trabajar con fondos transparentes, una característica especialmente práctica cuando una imagen debe integrarse posteriormente en un catálogo, una página web o una creatividad publicitaria.

A todo ello se suma la velocidad. OpenAI asegura que Images 2.5 puede reducir hasta un 50 % la latencia respecto a Images 2.0.

No significa que cualquier imagen vaya a estar terminada exactamente en la mitad de tiempo. El porcentaje es la mejora anunciada por la compañía y el resultado dependerá de la complejidad y condiciones de cada generación. Pero reducir los tiempos de espera puede tener bastante más importancia cuando se producen decenas de variantes que cuando se crea una única imagen.

Sketch, plantillas y comentarios para trabajar de forma más visual

OpenAI no ha limitado la actualización al modelo. ChatGPT incorpora nuevas herramientas destinadas a hacer que la creación dependa menos de escribir instrucciones cada vez más largas.

Una de ellas es Sketch.

La función permite dibujar directamente en ChatGPT y utilizar ese boceto como referencia. El usuario puede marcar aproximadamente dónde quiere colocar los elementos y acompañar el dibujo con una descripción del estilo o resultado buscado.

Para una campaña en redes sociales podría dibujarse rápidamente la posición del producto, reservar un espacio para el mensaje y señalar dónde debería aparecer otro elemento. Images 2.5 utiliza después esa referencia para construir la imagen.

No hace falta que el dibujo tenga calidad profesional. Su función es comunicar visualmente una composición que puede resultar complicada de explicar solo mediante palabras.

ChatGPT incorpora además plantillas para formatos creativos habituales, como carteles o productos de merchandising. En lugar de comenzar siempre desde una conversación vacía, el usuario dispone de estructuras sobre las que añadir información y preferencias visuales.

Otra novedad son los comentarios directamente sobre las imágenes. Permiten señalar con mayor precisión dónde se quiere realizar una modificación, algo especialmente útil cuando la petición afecta únicamente a una zona.

También cambia la forma de compartir los resultados. Una imagen puede compartirse junto al prompt utilizado para generarla, de modo que otra persona pueda reutilizar la idea con sus propios datos y fotografías.

Esta función puede tener aplicaciones dentro de equipos de marketing. Una persona puede desarrollar una estructura de prompt para un determinado tipo de creatividad y compartirla con otros miembros para generar variantes sin tener que reconstruir las instrucciones.

Flare y Sunburst llevan el modelo a campañas y aplicaciones

La actualización también afecta a empresas que integran generación de imágenes dentro de sus propias aplicaciones.

OpenAI ha presentado dos modelos para su interfaz de programación de aplicaciones (API): GPT-Image-2.5 Flare y GPT-Image-2.5 Sunburst.

Flare está pensado como la opción general para aplicaciones donde velocidad y volumen tienen bastante peso. OpenAI menciona entre sus posibles usos la creación de contenido para redes sociales, experiencias de producto, búsqueda visual, prototipos y generación a gran escala.

La compañía asegura que proporciona mayor calidad que GPT-Image-2 con un 50 % menos de latencia.

Sunburst adopta otro enfoque. Está dirigido a trabajos visuales que necesitan un control más preciso durante las sucesivas modificaciones y acepta tiempos de generación mayores.

OpenAI lo plantea para escenarios como creatividades de campañas preparadas para producción o imágenes de producto que requieren un acabado más cuidado.

Esta separación permite que una empresa elija entre velocidad y mayor precisión dependiendo de la tarea. Generar cientos de propuestas para probar conceptos no tiene los mismos requisitos que preparar la imagen definitiva de una campaña.

Para las redes sociales aparece además otra posibilidad: producir diferentes adaptaciones de una misma idea manteniendo una referencia común. Una creatividad puede necesitar versiones para publicaciones, formatos verticales, anuncios o diferentes plataformas. Una mayor consistencia entre ediciones puede reducir parte del trabajo necesario para obtener esas variantes, aunque seguirá siendo necesaria la revisión humana antes de publicar.

OpenAI mantiene también sus mecanismos para identificar contenido generado mediante sus herramientas. Images 2.5 utiliza metadatos C2PA y marcas de agua invisibles, junto con sistemas de seguridad aplicados tanto a las instrucciones como a las imágenes.

ChatGPT Images 2.5 está disponible para usuarios de ChatGPT, ChatGPT Work y Codex en escritorio, web y dispositivos móviles. Para desarrolladores, Flare y Sunburst trasladan las nuevas capacidades a aplicaciones externas mediante la API.

Para marketing la novedad más relevante quizá no esté en generar más imágenes, sino en poder corregirlas sin tener que regenerarlas continuamente. La primera versión producida por una IA rara vez es la definitiva. Mantener productos, personas, composición y estilo mientras se realizan pequeños cambios acerca estas herramientas a la forma en que realmente se prepara una creatividad antes de publicarla.

Preguntas frecuentes

¿Qué aporta ChatGPT Images 2.5 para redes sociales?

Permite generar creatividades y realizar modificaciones concretas intentando conservar el resto de la composición. También puede ayudar a preparar variaciones de una misma idea para diferentes contenidos y formatos.

¿Qué es Sketch en ChatGPT?

Sketch permite realizar un dibujo sencillo que ChatGPT utiliza como referencia visual. Puede servir para indicar la distribución aproximada de productos, personas y otros elementos antes de generar la imagen.

¿ChatGPT Images 2.5 es más rápido?

OpenAI afirma haber reducido la latencia hasta un 50 % frente a Images 2.0. El tiempo concreto dependerá de la imagen y de las condiciones de generación.

¿Cuál es la diferencia entre Flare y Sunburst?

GPT-Image-2.5 Flare prioriza velocidad y calidad para la mayoría de aplicaciones, incluidas aquellas con grandes volúmenes. GPT-Image-2.5 Sunburst está dirigido a trabajos que necesitan mayor precisión y control durante la edición, aunque requiere más tiempo de generación.

Lo último

×