ChatGPT se convierte en diseñador gráfico, nuestra prueba

ChatGPT Imágenes 2.0 es oficial y es verdaderamente una revolución para todos: para quienes simplemente disfrutan de la IA, para quienes buscan ideas para bocetos gráficos y para acompañar el trabajo personal, para quienes la usan para trabajos de productividad pero también quieren una apoyo para tareas gráficas profesionales.

¿Un verdadero diseñador gráfico a nuestro servicio? Juzga por ti mismo.

Con Images 2.0, lanzado ayer, OpenAI presenta una actualización que cambia la forma en que se generan las imágenes dentro de ChatGPT, pasando de un sistema basado principalmente en la representación visual a uno capaz de Interpretar, organizar y construir contenidos visuales complejos.. El nuevo modelo, gpt-image-2, mejora la precisión en la ejecución de instrucciones y el manejo de elementos difíciles como texto, interfaces y composiciones complejas.

La principal novedad es la integración de capacidad de razonamiento: En modos avanzados el sistema analiza la solicitud, planifica la estructura de la imagen y también puede acceder a la búsqueda en línea para obtener información actualizada.

El objetivo es hacer que las imágenes no sólo sean más realistas, sino también utilizable en contextos concretoscomo gráficos, comunicación y contenido editorial.

nuestra prueba

Probamos el sistema en múltiples campos para verificar su potencial en la creación de folletos, carteles, ilustraciones de varios tipos.. Los resultados muestran una alta calidad gráfica y, sobre todo, una notable capacidad de adaptación: el tono visual cambia en función del contenido, la estructura se autoorganiza, demostrando cómo es posible construir elementos agradables e «inteligentes» con poco esfuerzo y indicaciones muy simples, incluso si los diseñadores gráficos profesionales se vuelven un poco la boca…

La capacidad de razonar y el realismo.

En el caso de un menú piamontés, por ejemplo, el sistema lo introduce de forma autónoma platos típicos de la tradición local. En otros casos, como anuncios comerciales o carteles promocionales, adaptó gráficos y contenidos sin necesidad de instrucciones detalladas. En el cartel «fuera de todo» de la ferretería, por ejemplo, también intentó construir un logotipo, mientras que en el anuncio del MacBook Neo adaptó el estilo al contexto tecnológico.

También pedimos construir un cartel para una escuela primaria. El contenido ciertamente podría haber sido mejor y los gráficos menos obvios y más precisos, pero aquí el el aviso fue solo «Haz un cartel para una escuela primaria explicando por qué no comer dulces» y realmente no puedes quejarte demasiado…

La capacidad de razonamiento se nota también en la reelaboración de imágenes existentes o descritas. nos hemos transformado un cuadro de magrittehizo que las escenas fueran realistasLa última cena de Leonardo y de Baco de Caravaggioy creó una fotografía del Marcha del Cuarto Poder de Pellizza da Volpedocon resultados creíbles y consistentes.

Mensajes y textos minimizados

Como se mencionó, el sistema logra construir imágenes a partir de descripciones mínimas, integrando elementos no indicados explícitamente. Las caras conocidas se recuperan automáticamente: este es el caso de selfie de Leonardo con la Mona Lisaconstruido sin indicaciones detalladas; sólo “Leonardo da Vinci y la Mona Lisa se hacen un selfie con un iPhone Cosmic Orange en el estudio de Leonardo”.

macitynet.it

La gestión del contenido editorial también es muy interesante. Nosotros creamos dos periódicos imaginarios También con indicaciones simples: el modelo generó títulos, artículos y diseño de forma independiente.

En el caso del periódico dedicado al descubrimiento de La tumba de Tutankamóninsertó no sólo imágenes sino también anuncios acordes con la época histórica simulada. Los dos primeros tercetos de la Divina Comedia en japonés también son interesantes para quienes utilizan a menudo lenguas extranjeras con caracteres no latinos. Tenga en cuenta la ilustración de estilo Doré.

Infografías e información de Internet.

Las pruebas sobre las infografías destacaron una. buena capacidad para organizar la información. El de la historia de Apple nos impresionó mucho por su estructura, riqueza de información, elección de imágenes y precisión de los textos, con errores formales limitados y un resultado ya utilizable.

macitynet.it

En cuanto a la infografía sobre cómo funciona la IA, solicitamos tres estilos gráficos diferentes que fueron devueltos como se ve a continuación.

macitynet.it

Cómics y velocidad

Incluso la generación del cómic muestra interesante la inteligencia de Image 2.0. Afecta la capacidad de construir secuencias coherentes y actualizadas. En el cómic sobre la nominación de John Ternus como director ejecutivo de Applelas letras no se pueden definir como perfectas en contenido porque son un poco banales; por lo tanto, deberían corregirse en la fase de aviso, pero llama la atención que hay una referencia a una reunión con los empleados que tuvo lugar el día anterior a la ejecución, que se recuperó automáticamente.

macitynet.it

Por último, las pruebas sobre fotorrealismo, surrealismo e imágenes «falsas» también confirman un nivel muy alto. En algunos casos resulta difícil distinguir entre Imagen generada y fotografía real.especialmente cuando el modelo trabaja sobre escenas creíbles o reinterpretaciones realistas de contextos conocidos.

Durante las pruebas también surgió uno velocidad mucho mayor que en el pasadoincluso en la generación de escenas complejas y ricas en elementos. Al mismo tiempo, el sistema muestra un mayor precisión en la edición de imágenes: es posible intervenir en detalles específicos simplemente refinando el mensaje (como en la imagen del astronauta), obteniendo cambios específicos sin tener que reconstruir todo desde cero.

Los volantes y el uso actual.

Entonces, en general, Images 2.0 demuestra una capacidad de adaptarse a diferentes contextoscomprenda las solicitudes y produzca resultados estructurados sin la necesidad de indicaciones complejas.

Para aplicaciones como folletos, carteles o contenido editorial, el nivel alcanzado ya es más que adecuado para un uso semiprofesionalno sólo con una reducción de tiempos de trabajo sino proporcionando una herramienta para tareas que en su defecto requerirían horas y horas de trabajo de un diseñador gráfico.

Es difícil imaginar que la nueva implementación en este momento no afectará las herramientas en línea diseñadas para los creativos y la productividad.

¿Cuánto cuesta y dónde encontrar ChatGPT Images 2.0?

Imágenes ChatGPT 2.0 ya está disponible para todos los usuarios dentro de ChatGPT sin ninguna activación particular. Simplemente seleccione el modo de generación de imágenes y comience a escribir el mensaje.

Mejoras de calidadincluida una mejor gestión del texto, mayor precisión y gráficos más refinados, están disponibles para todos, incluso para usuarios gratuitos. Las funciones más avanzadas, como razonamiento, investigación en línea , en cambio, están reservados para los usuarios. Plus, Pro y Business.

En cuanto a los costos, en el uso normal dentro de ChatGPT las imágenes están dentro de los límites de su suscripción, mientras que para aquellos que usan la API, el modelo gpt-image-2 es de pago por uso, con precios que varían según la calidad y la resolución. En términos prácticos, una sola imagen puede costar desde unas milésimas hasta unas decenas de céntimos.