OpenAI presenta ChatGPT Images 2.5 con Sketch y más velocidad

El nuevo modelo reduce los tiempos de espera, mejora la fidelidad al editar imágenes y permite utilizar dibujos creados dentro de ChatGPT como referencia visual.

En resumen

  • ChatGPT Images 2.5 reduce la latencia de generación aproximadamente a la mitad.
  • Sketch permite dibujar dentro de una conversación y transformar el boceto mediante IA.
  • El modelo mejora la edición, el seguimiento de instrucciones y la creación de fondos transparentes.
  • La API ofrece GPT-Image-2.5 Flare y GPT-Image-2.5 Sunburst.

OpenAI ha presentado ChatGPT Images 2.5, una nueva generación de su sistema de inteligencia artificial para crear y editar imágenes. La actualización busca reducir los tiempos de espera, respetar mejor las instrucciones y conservar con mayor precisión los elementos incluidos en una imagen de referencia.

Según la compañía, la latencia se ha reducido aproximadamente a la mitad respecto a la generación anterior. El cambio permitirá obtener resultados con mayor rapidez, especialmente durante procesos que requieren crear varias versiones o realizar modificaciones sucesivas sobre una misma composición.

La actualización también estrena Sketch, una herramienta con la que los usuarios pueden dibujar directamente dentro de una conversación de ChatGPT y utilizar esos trazos como punto de partida para generar una imagen más elaborada.

Sketch convierte un dibujo en una imagen generada con IA

Sketch se activa escribiendo @sketch dentro de una conversación compatible. ChatGPT muestra entonces un lienzo en el que se puede dibujar utilizando el ratón, un panel táctil o una pantalla táctil.

La herramienta incluye diferentes colores y permite crear una representación sencilla de la idea. No es necesario realizar un dibujo detallado: el boceto puede utilizarse para señalar la posición de los personajes, la distribución de los objetos, las proporciones o la dirección que debe seguir la composición.

Una vez terminado, ChatGPT Images 2.5 interpreta los trazos junto con las instrucciones escritas por el usuario. De esta manera, un esquema básico puede convertirse en una ilustración, un personaje, una escena realista, un anuncio o un diseño para redes sociales.

Esta función reduce uno de los principales problemas de los generadores de imágenes: explicar únicamente con palabras dónde debe aparecer cada elemento. El dibujo proporciona una referencia espacial que puede ayudar al modelo a entender mejor la estructura deseada.

Imágenes más rápidas y mayor fidelidad en las ediciones

OpenAI asegura que el nuevo modelo mejora la generación de texturas, el tratamiento de la iluminación y la interpretación de instrucciones que contienen varios elementos.

ChatGPT Images 2.5 también está diseñado para conservar mejor los rostros, productos y detalles presentes en las imágenes originales. Esta capacidad resulta especialmente importante cuando el usuario quiere modificar un fondo, cambiar la ropa de una persona o añadir un objeto sin alterar innecesariamente el resto de la composición.

El seguimiento de instrucciones más preciso debería reducir el número de intentos necesarios para conseguir el resultado buscado. Sin embargo, las imágenes generadas todavía pueden contener errores en textos, manos, proporciones o pequeños detalles, por lo que conviene revisar el resultado antes de publicarlo.

Fondos transparentes y nuevas plantillas

Otra de las novedades es la posibilidad de solicitar imágenes con fondo transparente. Esta opción facilita la creación de logotipos, iconos, productos, personajes y recursos gráficos destinados a integrarse posteriormente en una página web, una miniatura o un diseño publicitario.

ChatGPT también incorpora plantillas para iniciar una creación desde una estructura preparada. Entre las categorías anunciadas se encuentran los logotipos, el diseño de interiores, los pósteres y el merchandising.

Las plantillas pueden acelerar los trabajos más habituales y ayudar a los usuarios que no saben cómo redactar una instrucción completa. Después de seleccionar una categoría, es posible personalizar el contenido, los colores, el formato y el estilo visual.

Dos modelos de ChatGPT Images 2.5 para la API

Los desarrolladores disponen de dos variantes dentro de la API. GPT-Image-2.5 Flare está orientado a la generación rápida de imágenes para tareas cotidianas, mientras que GPT-Image-2.5 Sunburst es el modelo más capaz y prioriza la precisión en los trabajos de generación y edición.

Ambos modelos admiten entradas de texto e imagen y permiten seleccionar diferentes niveles de calidad: low, medium, high, xhigh, max y auto. Pueden utilizarse mediante la API de imágenes o como modelo de la herramienta de generación visual en la Responses API.

El precio publicado para las dos variantes es de 5 dólares por cada millón de tokens de texto de entrada. Los tokens de imagen cuestan 8 dólares por millón en la entrada y 30 dólares por millón en la salida.

OpenAI aclara que el texto generado no se factura como salida porque estos modelos producen imágenes. El coste final de cada creación dependerá de factores como la resolución, la calidad seleccionada y el volumen de tokens de imagen utilizado.

Disponibilidad de ChatGPT Images 2.5

OpenAI ha comenzado a desplegar ChatGPT Images 2.5 en ChatGPT y en sus entornos de trabajo con generación visual. La aparición de las nuevas funciones puede ser gradual y variar según la cuenta, el plan utilizado o la plataforma desde la que se acceda.

La combinación de mayor velocidad, edición más precisa, fondos transparentes, plantillas y dibujos integrados convierte esta actualización en una mejora especialmente útil para diseñadores, creadores de contenido y usuarios que necesitan controlar mejor la composición de las imágenes generadas.

Sé respetuoso con los demás usuarios y no utilices lenguaje ofensivo o discriminatorio.

Artículo Anterior Artículo Siguiente