OpenAI ha presentado nuevas herramientas para ampliar las posibilidades de creación y modificación de imágenes en ChatGPT. Una de las actualizaciones más importantes es Sketch, una herramienta que permite dibujar un boceto en la conversación y luego usarlo como guía para crear una imagen.
La propuesta se basa en la idea de que existen composiciones que no se pueden explicar solo con texto. Con Sketch, el usuario tiene la posibilidad de realizar un boceto aproximado de lo que desea lograr y añadirle indicaciones sobre los materiales, el estilo o el acabado. La herramienta entiende ese esquema como una guía visual para crear la imagen definitiva.
No es necesario que el dibujo sea preciso. El boceto puede servir, por ejemplo, para indicar la distribución de una habitación, la forma de una prenda o la ubicación de diversos elementos en un cartel.
Más control sobre las ediciones
Sketch llega junto a ChatGPT Images 2.5, una nueva versión del sistema de generación y edición de imágenes de OpenAI.
La edición es uno de los principales cambios. El modelo busca identificar con más exactitud qué parte de una imagen necesita modificarse y cuáles deben permanecer intactas. De este modo, se pueden solicitar cambios de un producto específico, un fondo o un elemento concreto, sin alterar innecesariamente el resto de la composición.
La actualización también mejora la conservación de los cambios efectuados durante conversaciones largas. Esto permite realizar modificaciones sucesivas en una imagen a través de diversas fases sin perder con facilidad las características previamente establecidas.
ChatGPT incorpora además la posibilidad de hacer comentarios directamente sobre una imagen para señalar con mayor precisión la zona que se quiere modificar.
Mayor fidelidad a las imágenes de referencia
Images 2.5 también introduce mejoras cuando el usuario parte de una fotografía para crear una nueva imagen.
El sistema tiene como objetivo conservar con más precisión los objetos y las personas que se utilizan como referencia, incluso si cambian otros elementos, por ejemplo el estilo, la composición o el escenario. Además, se han introducido mejoras en aspectos visuales como la iluminación, las texturas y la interpretación de instrucciones más complejas.
Estas habilidades están especialmente enfocadas a usos profesionales, como la elaboración de imágenes de producto, materiales de presentación o contenidos para marcas, donde mantener determinados elementos visuales resulta importante.
La generación de imágenes será más rápida
La velocidad es otro de los elementos que OpenAI ha mejorado con esta actualización. Images 2.5 reduce hasta un 50% la latencia respecto a Images 2.0.
En los procesos en los que una imagen requiere varias rondas de edición, disminuir el tiempo de generación es especialmente relevante. En estas situaciones, la posibilidad de crear y modificar versiones más rápido hace que el uso de la IA se parezca a los flujos de trabajo más comunes en el diseño y la creación de contenido.
Plantillas para quienes no quieran empezar de cero
Otra de las novedades son las Templates, plantillas que permiten partir de estructuras prediseñadas para diferentes tipos de contenido.
La herramienta está pensada para aquellos usuarios que saben qué pieza desean crear, pero no necesariamente cómo transformar esa idea en un prompt. Los productos, carteles y artículos de merchandising son algunos ejemplos.
ChatGPT tiene la capacidad de pedir información adicional antes de crear la imagen para poder completar elementos vinculados al contenido, el diseño o el estilo.
Asimismo, se podrán compartir las imágenes junto con el prompt que se usó para generarlas. De este modo, otras personas tienen la posibilidad de reutilizar la estructura de una generación y ajustarla con sus propias imágenes o componentes.
Dos nuevos modelos llegan a la API
Las novedades también se extienden a la API de OpenAI con dos modelos: GPT-Image-2.5 Flare y GPT-Image-2.5 Sunburst.
Flare se presenta como una alternativa universal para aplicaciones y usos como la creación de contenidos, la búsqueda visual, las experiencias de producto o la producción a gran escala. Por otro lado, Sunburst da preferencia a un nivel de precisión más elevado, aunque para crear las imágenes necesita más tiempo. Esta especialmente orientado a trabajos que necesitan una supervisión minuciosa de las ediciones sucesivas.
Asimismo, OpenAI tiene sistemas para identificar el contenido creado por IA, como las marcas de agua invisibles y los metadatos C2PA.


