GPT-Image-1.5: a próxima geração da geração de imagens com IA

ChatGPT Images recebe uma atualização abrangente

A OpenAI lança uma nova geração de funcionalidades de imagem no ChatGPT, melhorando significativamente a velocidade, a precisão e a liberdade criativa.

Novo modelo de imagem como base

No centro da atualização está um novo modelo de imagem, disponível tanto no ChatGPT quanto via API com o nome gpt-image-1.5. Trata-se do modelo geral de texto-para-imagem mais poderoso da OpenAI até o momento. Segundo a empresa, as imagens são geradas até quatro vezes mais rápido do que antes, acelerando iterações e tornando o trabalho criativo mais fluido.

GPT-Image-1
Exemplo GPT-Image-1
Exemplo GPT Image 1
GPT-Image-1.5
Exemplo GPT-Image-1.5
Exemplo GPT Image 1.5

Prompt: Cena moderna de grande cidade ao pôr do sol, fotorrealista, arquitetura de vidro, muitas pessoas, ônibus elétrico autônomo com publicidade limpa para “ImageGen 1.5” e o subtítulo “Create what you imagine”, estilo fotográfico premium de smartphone.

Edição de imagens mais precisa com detalhes estáveis

Um avanço significativo aparece na edição de imagens existentes. As alterações agora são aplicadas de forma mais direcionada, enquanto elementos inalterados como iluminação, composição ou aparência das pessoas permanecem estáveis. Essa consistência se mantém ao longo de múltiplas edições.

Isso torna o ChatGPT Images mais adequado para correções fotográficas realistas, testes confiáveis de roupas ou penteados e ajustes estilísticos que preservam o caráter do original.

Diversos tipos de edição

O modelo oferece suporte a diferentes formas de edição, como adicionar, remover, substituir, combinar e mesclar conteúdos visuais. O objetivo é implementar ajustes desejados sem distorcer a imagem ou perder detalhes importantes. Em cenas complexas, a confiabilidade é claramente superior.

Transformações criativas sem barreira de prompt

O GPT-Image-1.5 também evolui nas transformações criativas. Texto, layout ou estilo podem ser alterados ou adicionados mantendo as características centrais da imagem. Essas transformações funcionam tanto para ideias simples quanto para conceitos complexos.

Além disso, agora é possível utilizar estilos e ideias de inspiração pré-definidos. Na nova interface de imagens, eles podem ser selecionados diretamente, sem a necessidade de prompts longos.

Melhor cumprimento de instruções

Em comparação com a primeira versão da geração de imagens, o novo modelo segue instruções de forma muito mais confiável. Isso inclui tanto alterações detalhadas quanto composições complexas com múltiplos objetos e relações bem definidas.

Grandes avanços na renderização de texto

Um progresso particularmente visível está na renderização de texto em imagens. O GPT Image 1.5 consegue ler e reproduzir textos menores e mais densos com muito mais precisão. Isso possibilita jornais realistas, pôsteres ou infográficos com textos, números e formatações preservados.

Nova área de imagens no ChatGPT

Além da entrada tradicional por texto, a OpenAI introduz uma área dedicada a imagens no ChatGPT. Ela pode ser acessada pela barra lateral do aplicativo e em chatgpt.com. Estão disponíveis diversos filtros pré-configurados e prompts de inspiração atualizados regularmente.

Chatgpt Images

Além disso, é possível salvar uma imagem de referência da própria aparência para reutilização posterior. Com a maior velocidade, várias ideias de imagem podem ser exploradas em paralelo.

Melhorias adicionais de qualidade

Além das funções principais, o modelo melhora detalhes como a representação de muitos rostos pequenos, a nitidez em cenas complexas e a naturalidade geral dos resultados. Comparações com versões anteriores mostram imagens mais vivas e completas.

ChatGPT Images no uso profissional

Para empresas, a atualização traz benefícios claros. Geração mais rápida de imagens, edições precisas e consistência visual ajudam equipes em ideação, visualização e execução. Áreas típicas incluem marketing, design, e-commerce e comunicação interna.

Avanços com uma visão realista dos limites

A OpenAI revisitou exemplos anteriores e identificou progressos claros. Ainda assim, os resultados não são perfeitos em todos os casos. Em cenários complexos ou científicos, imprecisões ainda podem ocorrer.

GPT-Image-1.5 na API

A versão da API oferece as mesmas melhorias do ChatGPT Images. Destaca-se a manutenção mais estável de logotipos e elementos visuais centrais ao longo de múltiplas edições. Isso torna o modelo ideal para branding, marketing e e-commerce, como a criação de catálogos completos de produtos a partir de uma única imagem base.

Além disso, entradas e saídas de imagens são cerca de 20% mais baratas do que no GPT-Image-1. O novo modelo pode ser testado no OpenAI Playground, com suporte adicional de um guia de prompts para imagens.

Primeiros feedbacks da prática

Empresas de áreas como ferramentas criativas, software de marketing e lojas online já utilizam o GPT-Image-1.5. Destacam-se a alta qualidade das imagens, a execução confiável das instruções e a consistência em composição, iluminação e detalhes, permitindo fluxos de trabalho mais rápidos.

Disponibilidade e contexto

O GPT-Image-1.5 está sendo disponibilizado globalmente para usuários do ChatGPT e da API, funcionando automaticamente sem seleção manual de modelo. Segundo a OpenAI, esta atualização marca um passo importante, com melhorias adicionais em detalhes, edição e suporte multilíngue já planejadas.

Testar o GPT-Image-1.5 gratuitamente

Por meio deste gerador de imagens com IA, você pode criar imagens gratuitamente com o modelo GPT-Image-1.5.

Mais exemplos, informações adicionais e detalhes técnicos aprofundados estão disponíveis no artigo detalhado no blog sobre a nova versão do ChatGPT Images.


Publicado

em

por