Algunas ideas resultan mucho más sencillas de dibujar que de explicar con palabras. Partiendo de esa premisa, OpenAI ha presentado Sketch, una nueva función de ChatGPT que permite realizar un boceto directamente dentro de la conversación y utilizarlo como referencia para generar después una imagen completa.
La herramienta llega acompañada de ChatGPT Images 2.5, la nueva evolución del sistema de generación y edición de imágenes de OpenAI. La compañía asegura que cada semana se crean ya más de 3.000 millones de imágenes entre ChatGPT Images y los modelos GPT-Image utilizados mediante su API, y con esta actualización busca ofrecer más control sobre el proceso creativo, especialmente a medida que la generación visual empieza a incorporarse a flujos profesionales de diseño, marketing, comercio o medios.
Con esta actualización busca ofrecer más control sobre el proceso creativo
Así, Sketch introduce una nueva forma de dar instrucciones a la inteligencia artificial. El usuario puede escribir @Sketch en ChatGPT, abrir un lienzo y dibujar aproximadamente aquello que tiene en mente. Después puede acompañar el boceto de indicaciones sobre estilo, acabado u otros detalles para que el sistema genere la imagen definitiva. No es necesario, por tanto, saber dibujar. El boceto funciona como una referencia espacial y visual que complementa las instrucciones escritas.
OpenAI pone como ejemplos la distribución de una habitación, el contorno de una prenda o un simple garabato, aunque la función puede extenderse a diagramas, carteles y otras composiciones en las que describir mediante texto la posición exacta de cada elemento puede resultar complicado.
Sketch supone así un paso más en la evolución de las interfaces de generación visual. El prompt deja de ser necesariamente el único punto de partida y el usuario puede comunicar una intención mediante una combinación de lenguaje e información gráfica.
Ediciones más precisas sin alterar el resto de la imagen
Junto a Sketch, una de las mejoras principales de Images 2.5 está orientada a un problema habitual de la edición mediante IA: pedir que cambie una cosa y comprobar que también han cambiado otras.
OpenAI asegura que el nuevo modelo identifica mejor qué elementos debe modificar y cuáles debe conservar. Esto permite, por ejemplo, sustituir un producto, un fondo o un texto tratando de mantener intactos el sujeto, la composición y el tratamiento visual del resto de la pieza.

También mejora la consistencia durante conversaciones largas. Cuando una imagen atraviesa varias rondas de cambios, Images 2.5 debería conservar con mayor fiabilidad las modificaciones anteriores y mantener la calidad mientras incorpora las nuevas instrucciones. Esta capacidad tiene especial relevancia para usos profesionales, donde una imagen rara vez se resuelve con una única generación. Mantener un producto, una persona, una composición o determinados códigos de marca mientras se producen diferentes versiones acerca el funcionamiento de la IA a un proceso de edición iterativo.
ChatGPT incorpora además comentarios directamente sobre las imágenes, de modo que el usuario pueda señalar de manera más localizada aquello que desea modificar en lugar de describirlo únicamente mediante un mensaje general.
Más fidelidad a las fotografías de referencia y mejores composiciones
Images 2.5 también busca preservar mejor a las personas y objetos presentes en fotografías utilizadas como referencia. Según OpenAI, los sujetos deberían resultar más reconocibles después de cambiar el escenario, el estilo visual o la composición, mientras que la iluminación y las texturas ganan naturalidad.
La actualización mejora igualmente la interpretación de instrucciones visuales complejas y la creación de composiciones con numerosos elementos. OpenAI destaca avances en infografías, materiales de presentación y fondos transparentes, así como una mayor capacidad para respetar una dirección artística concreta cuando las instrucciones se vuelven progresivamente más específicas.
La velocidad es otro de los cambios: OpenAI asegura haber reducido hasta un 50% la latencia de generación respecto a Images 2.0, buscando acelerar tanto la creación inicial como las sucesivas iteraciones sobre una misma idea.
Plantillas para carteles, productos y otros formatos
La actualización incorpora también Templates, un sistema pensado para quienes saben qué tipo de pieza necesitan pero no necesariamente cómo redactar el prompt adecuado.
Desde la sección Images de ChatGPT se puede partir de plantillas para formatos creativos habituales y proporcionar la información, los elementos de diseño o el estilo deseado. Entre los ejemplos mostrados por OpenAI aparecen carteles, productos y merchandising. ChatGPT puede plantear preguntas adicionales para completar las instrucciones antes de generar la pieza.
Los prompts se podrán compartir
Otra de las novedades está pensada para hacer reutilizables las generaciones que funcionan especialmente bien. Al compartir una imagen, ChatGPT permite incluir también el prompt con el que se ha creado.
Otra persona puede utilizar después esas instrucciones e introducir sus propias fotografías o detalles para producir una versión diferente. De esta manera, un buen prompt puede funcionar prácticamente como una plantilla compartida entre compañeros, equipos o usuarios.
La función también puede contribuir a acelerar la difusión de tendencias visuales. OpenAI utiliza como ejemplo un prompt que recrea cómo habría sido el retrato de una persona en los años 80: cada usuario puede mantener la estructura creativa y sustituir al protagonista por sí mismo.
La actualización llega también a la API con dos modelos diferentes. GPT-Image-2.5 Flare incorpora las mejoras de calidad, edición y velocidad y está planteado como la opción general para aplicaciones, creación de contenido, experiencias de producto, búsqueda visual, prototipado y generación a gran escala. OpenAI señala que ofrece mayor calidad que GPT-Image-2 con una latencia un 50% inferior.
GPT-Image-2.5 Sunburst, por su parte, prioriza la precisión aunque requiere más tiempo de generación. Está orientado a trabajos visuales donde el control entre sucesivas ediciones resulta especialmente importante, como creatividades publicitarias listas para producción o imágenes de producto con un acabado más cuidado.
La compañía mantiene además sus mecanismos de identificación de contenido generado mediante IA, incluyendo metadatos C2PA y marcas de agua invisibles.
ChatGPT Images 2.5 está desplegándose para los usuarios de ChatGPT, ChatGPT Work y Codex en escritorio, móvil y web, mientras que Flare y Sunburst están disponibles para desarrolladores mediante la API.