ChatGPT Images 2.5 vs 2.0, nos mesmos prompts

ChatGPT Images 2.5 vs ChatGPT Images 2.0

Seis prompts rodaram no ChatGPT Images 2.5 e no 2.0, no mesmo tamanho e no mesmo tier de qualidade. Um cartaz com o bloco de créditos em corpo pequeno. Um diagrama com sete peças nomeadas. Um retrato que junta pele, tecido e metal no mesmo quadro. O mesmo rosto levado para outro cenário a partir de uma foto de referência. Uma edição de um único elemento, com uma lista longa do que não pode mudar. E um briefing que você confere contando. Cada prompt aparece impresso embaixo do par, então dá para repetir o teste com o seu material, seja um cartaz de evento, um infográfico para o feed ou a arte de um anúncio.

O mesmo prompt, seis vezes

Tipo pequeno: um cartaz com bloco de créditos

Cartaz de festival de cinema gerado com o ChatGPT Images 2.0
ChatGPT Images 2.0
O mesmo cartaz de festival de cinema gerado com o ChatGPT Images 2.5
ChatGPT Images 2.5
Um cartaz em que a letra miúda precisa ser legível

Cartaz impresso de um festival de cinema, com cara de offset e textura de papel à mostra. Um sol baixo de inverno fica atrás de uma linha de cume nua e joga sombras azuis compridas sobre um campo de neve, na metade de baixo. Tratamento chapado em duas cores, azul-marinho profundo e um branco osso quente, com um fio fino em tom latão cruzando o meio. O título NORTHLIGHT aparece uma única vez no terço superior, em serifada alta e condensada, com entreletras bem aberto. Logo abaixo, em uma linha só, FEB 14 TO 22 2027 REYKJAVIK. No pé, um bloco de créditos de cinco linhas em caixa alta de uma grotesca pequena, discreto e ainda assim legível, com direção, fotografia, montagem, trilha e patrocínio. Cada palavra nítida até o contorno da letra, sem nenhum texto extra no quadro.

Infográficos: um diagrama com rótulos e números reais

Corte técnico de máquina de espresso com rótulos, gerado com o ChatGPT Images 2.0
ChatGPT Images 2.0
O mesmo corte de máquina de espresso gerado com o ChatGPT Images 2.5
ChatGPT Images 2.5
Sete peças nomeadas, cada rótulo em sua linha

Ilustração técnica em corte de uma máquina de espresso doméstica, desenhada como diagrama de linha preciso, com preenchimentos chapados, sobre um fundo branco sujo e quente. O corte deixa à vista o reservatório de água, a bomba, a caldeira, o grupo, o porta-filtro, o vaporizador e a bandeja de resíduos. Sete linhas finas de chamada saem para rótulos em caixa alta de uma grotesca pequena, cada linha encostando na peça que nomeia, nesta ordem: WATER TANK, PUMP, BOILER, GROUP HEAD, PORTAFILTER, STEAM WAND, DRIP TRAY. Sob o desenho, uma legenda de uma linha só, SINGLE BOILER MACHINE, SECTIONED. Paleta de cinza aço, vermelho óxido e um único acento em verde azulado. Somente tons chapados, sem clip art e sem gradiente decorativo.

Detalhe: pele, tecido e metal no mesmo quadro

Retrato de um soldador gerado com o ChatGPT Images 2.0
ChatGPT Images 2.0
O mesmo retrato de soldador gerado com o ChatGPT Images 2.5
ChatGPT Images 2.5
Três materiais, uma luz motivada

Retrato em 35mm de um soldador no alto de uma obra, na primeira luz do dia. Atrás dele, um céu de amanhecer azul e frio. Uma única luminária de trabalho, quente, ilumina o rosto pela esquerda. Ele tem uns quarenta e poucos anos, pele morena castigada pelo tempo, com poros de verdade à mostra. Barba de alguns dias, já grisalha, suor brilhando na testa e rugas fundas de expressão. Veste um avental de couro surrado sobre uma malha térmica grossa. Na mão, um maçarico de corpo em latão solta um fio fino de fumaça pela ponta. Enquadramento da cintura para cima, pouca profundidade de campo, guindastes desfocados ao fundo. Tom documental honesto, pele natural e irregular, sem nenhum retoque.

Fidelidade à referência: o mesmo rosto, outro cenário

O retrato de referência entregue aos dois modelos
Entrada, dada aos dois
A pessoa da referência recriada em outro cenário pelo ChatGPT Images 2.0
ChatGPT Images 2.0
A pessoa da referência recriada em outro cenário pelo ChatGPT Images 2.5
ChatGPT Images 2.5
A mesma pessoa, outro ambiente

Use a fotografia anexada como referência da pessoa. Coloque a mesma mulher em um viveiro de mudas ao meio-dia, de pé entre duas fileiras de bandejas de plantio, sob a estufa de plástico que difunde a luz lá de cima. Mantenha o rosto, a estrutura óssea, a distância entre os olhos, a linha do cabelo, o tom de pele e a pequena pinta na bochecha esquerda exatamente como estão na referência. Mude apenas três coisas: o cenário, a roupa, que passa a ser uma camisa de trabalho em lona, e a luz. Enquadramento de três quartos, expressão natural, sem retoque.

Edição: mude uma coisa e preserve o resto

A imagem de interior que os dois modelos receberam para editar
Entrada, dada aos dois
O interior editado devolvido pelo ChatGPT Images 2.0
ChatGPT Images 2.0
O interior editado devolvido pelo ChatGPT Images 2.5
ChatGPT Images 2.5
Um elemento muda, treze continuam presos

Troque apenas as quatro cadeiras brancas da sala de jantar por cadeiras de carvalho claro, no mesmo formato e na mesma proporção. Preserve o ângulo da câmera e o enquadramento. Preserve a mesa, a louça posta, o tapete, as tábuas do piso e a direção do veio da madeira. Preserve a cor da parede, o quadro e a posição dele, o pendente, a janela, a direção da luz, cada sombra no chão e a qualidade geral da imagem. Nada mais na imagem pode mudar.

Seguir instruções: detalhe que dá para contar

Bancada de ourives vista de cima, gerada com o ChatGPT Images 2.0
ChatGPT Images 2.0
A mesma bancada de ourives vista de cima, gerada com o ChatGPT Images 2.5
ChatGPT Images 2.5
Cinco ferramentas em ordem, e duas posições

Fotografia de cima de uma bancada de ourives em carvalho gasto, com a câmera perpendicular ao tampo e uma única luz suave de janela entrando pelo topo do quadro. Exatamente cinco ferramentas ficam em fila única no meio, bem espaçadas, da esquerda para a direita nesta ordem: um mandril de aço para anéis, um alicate de bico redondo, um pequeno martelo de bola, um arco de serra de ourives e uma flanela de polimento dobrada. Acima da fila, à esquerda do centro, um prato raso de cerâmica com exatamente três anéis de latão. Abaixo da fila, à direita do centro, uma caneca de esmalte azul. Não há mais nada sobre a bancada. Marcas de uso reais em cada ferramenta, poeira fina de metal no veio da madeira, sombras curtas e honestas caindo para baixo.

As configurações são metade da atualização

Duas das diferenças não têm nada a ver com o comportamento do modelo, e passam batido justamente porque o prompt continua o mesmo.

Os tiers de qualidade acima do high. O Images 2.0 parava no high. O 2.5 acrescenta xhigh e max, cada um mais lento que o anterior. A OpenAI os posiciona para o detalhe da letra miúda em trabalho que vai para a gráfica.

O quadro deixou de ser três formatos. O Images 2.0 oferece 1:1, 3:2 e 2:3 no Studio, até 2K. O Images 2.5 aceita de 1:3 a 3:1, em tamanhos personalizados múltiplos de 16 pixels, com lado de até 3840 pixels. O quadrado é o formato mais caro em qualquer tier, ou seja, um 16:9 na mesma resolução nominal sai mais barato que um 1:1.

Flare ou Sunburst. Pedir o ChatGPT Images 2.5 no Morphic entrega o GPT-Image-2.5 Flare, o padrão rápido e o modelo de todos os testes acima. O Sunburst é o tier de precisão e demora mais. A OpenAI sugere fechar a qualidade primeiro no Sunburst e só depois testar se o Flare alcança o mesmo nível.

Rodando os dois no Morphic

As duas gerações estão no Morphic, no mesmo chat e no mesmo Canvas, com imagens de referência, edição e a lista completa de tiers de qualidade. Foi isso que tornou esta página possível: o mesmo prompt, enviado aos dois, sem mais nada mudando no caminho.

É também o que faz valer a pena repetir a comparação nos seus próprios briefings. Mande um prompt para o ChatGPT Images 2.5 e para o ChatGPT Images 2.0 lado a lado. Se nenhum dos dois resolver, mande o mesmo prompt para o Nano Banana Pro, o Seedream 5 Pro ou o Flux 2 Pro, sem sair do mesmo lugar.

Perguntas frequentes

Qual a diferença entre o ChatGPT Images 2.5 e o 2.0?

A OpenAI cita detalhe mais nítido, luz e textura mais naturais, melhor preservação de pessoas vindas de fotos de referência, edição mais estável ao longo de uma conversa longa, infográficos mais precisos e geração até 50% mais rápida. O 2.5 também acrescenta dois tiers de qualidade acima do teto antigo e saída de até 4K.

O ChatGPT Images 2.5 é mais rápido que o 2.0?

A OpenAI mede o GPT-Image-2.5 Flare em até metade da latência do Images 2.0 com qualidade equivalente. O tempo de render muda conforme o prompt, as imagens de referência e a configuração de qualidade, então vale cronometrar nos seus próprios briefings.

Os dois escrevem texto em português dentro da imagem, com acento e cedilha?

Os dois aceitam o texto que você pedir e o imprimem no quadro. O teste do cartaz e o do diagrama nesta página existem exatamente para isso: eles fixam a frase no prompt e deixam você conferir letra por letra no resultado. Troque o texto dos exemplos pelo seu, com acentos e cedilha, rode o par e compare os dois lados antes de fechar a arte.

Preciso reescrever os prompts que eu usava no ChatGPT Images 2.0?

Não. A forma de escrever o prompt não mudou de uma geração para a outra, então o que funcionava no 2.0 funciona no 2.5. O que vale revisar são as configurações: o tier de qualidade, o tamanho da saída e se o trabalho pede Flare ou Sunburst.

Usar Flare ou Sunburst?

O Flare é o padrão e foi o modelo de todos os testes desta página. A OpenAI o descreve como equivalente ao GPT Image 2 em qualidade, com até metade da latência, e apresenta o Sunburst como o tier de precisão, para trabalhos que exigem controle mais firme ao longo de uma sequência de edições, com geração mais demorada.

Dá para rodar os dois modelos no Morphic?

Dá. O ChatGPT Images 2.5 e o ChatGPT Images 2.0 rodam os dois no Morphic, no mesmo chat e no mesmo Canvas, com imagens de referência, edição e a lista completa de tiers de qualidade. Foi assim que cada par desta página foi feito.