Testamos o GPT Image 2.5 contra o GPT Image 2 em 15 testes lado a lado, que cobrem preservação de identidade, composição com várias referências, edição sequencial, controle de estilo, tipografia, diagramas, mockups de interface, design de sites e concept art. O GPT Image 2.5 mostrou uma melhora perceptível em qualidade artística, composição e capacidade de gerar composições densas e complexas, além da velocidade de geração: o GPT Image 2 levou em média 160 segundos por geração, enquanto o GPT 2.5 Flare levou apenas 30 segundos.
Os dois modelos receberam o mesmo prompt, as mesmas imagens de entrada quando aplicável, a mesma proporção de tela e a mesma configuração de alta qualidade. Usamos o GPT Image 2.5 Flare, que vamos chamar apenas de GPT Image 2.5 para simplificar.
Edição de fotos
Vestindo um corgi de astronauta
A partir de uma foto de um corgi, pedimos ao modelo para vestir o cachorro com um traje espacial laranja, colocar um capacete branco ao lado dele e preservar o cachorro, a pose, a expressão, o fundo amarelo e a iluminação.
Corgi de astronauta: GPT Image 2 vs GPT Image 2.5
Nenhum dos modelos teve dificuldade em seguir o prompt ou preservar a semelhança; no entanto, olhando os detalhes, a imagem do GPT Image 2.5 exibe detalhes secundários e terciários de contexto mais interessantes (as tiras, o logo da NASA no capacete, um reflexo mais detalhado na viseira), o que a torna muito mais interessante de olhar.
Vencedor: GPT Image 2.5
Transformando uma selfie casual em uma foto corporativa
Pedimos aos dois modelos para transformar uma selfie casual em uma foto profissional sem alterar a pessoa. Nenhum dos dois teve dificuldade aqui, então este teste é um empate.
Selfie casual transformada em foto corporativa
Vencedor: empate
Combinando três pessoas em uma única foto de festa
O teste com várias referências pediu aos modelos que combinassem três pessoas de selfies separadas em uma única foto espontânea de aniversário em um terraço.
Três selfies separadas combinadas em uma foto de festa no terraço
Os dois modelos completaram a tarefa sem detalhes, mas o GPT Image 2.5 acrescentou mais microdetalhes que tornam a cena crível — repare no gelo nas bebidas e na iluminação mais quente.
Vencedor: GPT Image 2.5
Edição em várias etapas
Trocando a roupa e depois levando a pessoa para Paris
Nossa primeira sequência de edições começou com uma foto de corpo inteiro feita em estúdio.
Uma sequência de três edições de roupa e fundo
A primeira etapa trocou uma camiseta escura por uma camisa de linho branca.
A segunda etapa acrescentou uma jaqueta bomber de couro marrom aberta.
A terceira etapa trocou o estúdio por uma rua de Paris na hora dourada.
Em todas as etapas, o rosto, o cabelo, a pose, a calça e o tênis deveriam permanecer inalterados.
Os dois modelos completam as três edições sem nenhum problema, sem melhora visível aqui.
Vencedor: Empate
Mudando três velas para sete e depois acrescentando um texto exato
A sequência do bolo de aniversário isola dois pontos clássicos de falha: contagem e edições localizadas. Os dois modelos primeiro geraram um bolo de chocolate com exatamente três velas acesas. Em seguida, pedimos exatamente sete velas sem mudar mais nada, e depois um pequeno topo branco com os dizeres “Happy 30th, Lena” em letra dourada.
De três velas para sete e depois um topo de bolo com texto exato
Os dois modelos completaram o teste sem falhas e não erraram a contagem. Do ponto de vista artístico, a versão do GPT Image 2.5 parece mais detalhada e interessante, na nossa opinião, mas julgando estritamente pela precisão, este é um empate.
Vencedor: Empate
Controle de estilo
Um café na chuva em quatro estilos
Demos aos dois modelos a mesma cena — um café de esquina em uma rua chuvosa à noite — e pedimos que a renderizassem em quatro estilos:
O mesmo café de esquina na chuva renderizado em quatro estilos
Uma capa de revista retrofuturista dos anos 1950
Uma pintura a óleo impressionista
Um mosaico de azulejos azuis e dourados
Uma fotografia cinematográfica cyberpunk.
É aqui que vemos o GPT Image 2.5 abrir uma vantagem significativa — sua interpretação artística de cada estilo é muito mais fiel, e cada estilo fica mais distinto. Na versão pintada à mão dá para ver claramente as pinceladas, enquanto o mosaico parece um mosaico de verdade. As cores são mais vivas e vibrantes. O modelo também escolheu fontes mais interessantes para a tipografia.
Vencedor: GPT Image 2.5
Interpretando quatro tradições artísticas famosas
O quadro seguinte pediu o mesmo tema, uma jovem lendo uma carta perto da janela, através de quatro tradições visuais conhecidas, associadas a Vincent van Gogh, Katsushika Hokusai, Gustav Klimt e Edward Hopper.
Uma mulher lendo uma carta em quatro tradições artísticas famosas
Nas tentativas do GPT Image 2, dá para adivinhar o estilo do pintor, mas partes da imagem, principalmente os rostos, parecem o estilo genérico de imagem gerada por IA. Já o GPT 2.5 quase parece uma obra real daquele pintor.
Vencedor: GPT Image 2.5
Uma cena de produto em quatro técnicas de renderização
Para separar conhecimento de estilo de complexidade de cena, também usamos uma simples lambreta vermelha em frente a uma padaria e fornecemos apenas indicações curtas de técnica: 3D estilizado, óleo empastado, fotografia de produto editorial e brilhante, e aquarela com nanquim.
Uma cena com lambreta vermelha em quatro técnicas de renderização
De novo, o GPT Image 2.5 cria a separação mais clara. Os materiais mudam de forma mais decidida de quadro para quadro: a laca e o cromado parecem projetados na imagem editorial, a versão a óleo carrega tinta física visível, e a aquarela deixa um papel convincente e bordas soltas.
Vencedor: GPT Image 2.5
Texto e layout
Um convite de casamento
Nenhum dos modelos teve problema com o texto, mas o GPT Image 2.5 usa uma composição um pouco mais arejada, e a imagem como um todo parece mais polida e agradável de olhar. Mas, no que diz respeito à precisão da renderização do texto, este é um empate.
Um convite de casamento em creme e dourado com nomes e datas exatos
Vencedor: Empate
Um slide explicativo em quatro etapas sobre explosões solares
O teste de apresentação combinou conhecimento de mundo com layout. O slide precisava de um título, uma imagem grande do Sol e quatro etapas em ordem: as linhas do campo magnético se torcem, manchas solares se formam, reconexão magnética e liberação de energia.
Um slide explicativo em quatro etapas sobre explosões solares
As duas saídas acertam a sequência, a ortografia, a numeração e a história científica como um todo. O GPT Image 2.5 tem infográficos mais precisos, o que lhe dá uma pequena vantagem.
Vencedor: GPT Image 2.5
Seis selos de parques nacionais com legendas
Pedimos aos dois modelos para criar uma grade de selos 3 x 2. Mais uma vez, o GPT Image 2.5 entrega imagens mais vivas e artísticas, que parecem muito menos com visuais genéricos gerados por IA, em comparação com o GPT 2.
Seis selos vintage de parques nacionais com legendas
Vencedor: GPT Image 2.5
Um pôster tipográfico de festival de jazz
Para o pôster, fornecemos o texto do evento, mas deixamos a composição, a combinação de fontes, a hierarquia e a cor por conta do modelo.
Um pôster tipográfico de festival de jazz
O GPT Image 2.5 fez uma versão com um design gráfico mais limpo e escolheu uma fonte mais interessante. Para designs com carga tipográfica pesada, ele definitivamente mostra uma melhora perceptível em relação ao GPT Image 2.
Design
Um deck de investidores no Google Slides
Pedimos aos dois modelos para gerar uma captura de tela verossímil de um deck de dez slides dentro do Google Slides. Os modelos tinham que gerar a interface do navegador, os menus, as barras de ferramentas, a tira de miniaturas, o slide selecionado e variação suficiente entre as miniaturas para sugerir uma história completa.
Um deck de dez slides dentro da interface do Google Slides
Curiosamente, os dois modelos produziram um deck plausível sobre cuidados com plantas chamado Leafly, e tivemos dificuldade em encontrar qualquer coisa que indicasse uma melhora na versão do GPT Image 2.5.
Vencedor: Empate
A página inicial de um site de café especial
Pedimos aos modelos para desenhar um site para uma marca de café especial, completo com barra de navegação, seção hero, cards de produto, depoimentos e rodapé, para uma assinatura fictícia de café chamada Morrow.
Conceito de página inicial de um site de café especial
Este teste mostrou que o GPT Image 2.5 é um modelo melhor para design de interface ou iteração rápida: ele criou um layout com mais acabamento e um uso mais deliberado do espaço negativo, que parece mais profissional, mais agradável aos olhos e mais realista como um site que poderia existir de verdade.
Um painel de concept art para uma base de pesquisa em Marte
Por fim, pedimos aos dois modelos para criar uma prancha de design industrial com uma grande vista de apresentação de uma base de pesquisa em um Marte terraformado, além de estudos menores de um rover, um módulo de habitação e o equipamento da tripulação, todos com anotações soltas.
Um painel de concept art para uma base de pesquisa em Marte
Concept art é uma área em que a maioria dos modelos tem dificuldade, e dá para ver isso na versão criada pelo GPT Image 2 — ela parece legal de longe, mas quando você aproxima dá para ver que os projetos não são funcionais, e que muitas linhas, vistas de perto, estão ali apenas para ocupar espaço; são basicamente rabiscos. Repare também no tom esverdeado geral e na paleta de cores apagada.
Olhando a versão do GPT Image 2.5, você nota imediatamente as cores mais vibrantes e uma concept art mais detalhada, mas a maior melhora está nos detalhes: existem miniaturas reais de vista lateral e frontal do rover, os detalhes do equipamento do astronauta são mostrados separadamente, e o módulo de habitação, se você aproximar, tem plantas de ambiente de verdade — elas não fazem muito sentido (do jeito que está, você precisa passar pelo banheiro para ir dos alojamentos até o laboratório), mas estão incluídas em grande detalhe, onde o GPT Image 2 acrescentou o que é essencialmente hachura e linhas aleatórias para sugerir detalhe. Para concept art e design, o GPT Image 2.5 é uma melhora geracional.
Vencedor: GPT Image 2.5
Considerações finais
Ao longo dos 15 testes, o GPT Image 2.5 foi o vencedor claro: ganhou 10 rodadas, enquanto as outras cinco terminaram empatadas. O GPT Image 2 não venceu nenhuma rodada de forma isolada, mas se manteve competitivo em edições mais simples, precisão de texto e recriação de interfaces.
A maior diferença estava no julgamento criativo. O GPT Image 2.5 produziu de forma consistente composições mais fortes, detalhes mais ricos, mais fidelidade de estilo e resultados mais convincentes quando o prompt envolvia várias pessoas, layouts densos, tipografia ou concept art.
A velocidade tornou o upgrade ainda mais perceptível. Nos nossos testes, o GPT Image 2 levou cerca de 160 segundos por geração em média, enquanto o GPT Image 2.5 Flare costumava terminar em cerca de 30 segundos. Isso torna a iteração muito mais prática, principalmente quando você precisa explorar várias direções visuais.
Para edições simples de imagem, o GPT Image 2 ainda dá conta, e a diferença nem sempre é dramática. Mas para trabalho de design, narrativa visual, composições complexas e iteração criativa rápida, o GPT Image 2.5 é uma melhora geracional relevante.