A OpenAI apresenta o ChatGPT Images 2.5, novo modelo de geração de imagens com avanços na qualidade, na edição e no tempo de criação. A ferramenta está disponível no ChatGPT, no ChatGPT Work e no Codex, em computadores, dispositivos móveis e na web.
A empresa informa que o modelo produz iluminação mais natural, texturas mais detalhadas e resultados mais fiéis ao usar imagens de referência. A latência de geração também cai em até 50% na comparação com o Images 2.0.
Edições e criação a partir de esboços
O sistema passa a concentrar melhor as alterações no elemento solicitado, mantendo o assunto principal, a composição e o fundo da imagem. A OpenAI também aponta maior estabilidade em sequências de edição: mudanças anteriores tendem a ser preservadas quando o usuário acrescenta novos comandos.
O modelo lida ainda com instruções visuais complexas, informações do mundo real e layouts elaborados, inclusive imagens com fundo transparente. A empresa afirma que a reprodução de estilos visuais também ficou mais precisa.
Entre os novos recursos está o Sketch, que permite fazer um desenho no próprio ChatGPT e usá-lo como referência para gerar uma imagem. O esboço pode indicar, por exemplo, a disposição de um ambiente, o formato de uma roupa ou uma ideia visual. Para ativar a ferramenta, o usuário deve digitar “@Sketch”.
A atualização inclui templates para formatos como “Poster” e “Merch”. O usuário escolhe um modelo inicial e adiciona informações, elementos de design e estilos. Também é possível compartilhar a imagem junto com o prompt utilizado, permitindo que outra pessoa reaproveite a ideia com imagens e detalhes próprios.
Opções para desenvolvedores
A OpenAI disponibiliza dois modelos na API: GPT-Image-2.5 Flare e GPT-Image-2.5 Sunburst. O Flare reúne os ganhos de qualidade, edição e velocidade e é indicado pela empresa como opção padrão para a maioria das aplicações. A OpenAI afirma que ele supera o GPT-Image-2 em qualidade e tem 50% menos latência.
O Sunburst é voltado a fluxos que precisam de mais controle nas edições, como trabalhos criativos e imagens de produtos. Os dois modelos estão disponíveis na API.
O Images 2.5 mantém verificações de prompts e imagens, além de metadados C2PA e marca d’água invisível para auxiliar na identificação de conteúdos produzidos pelas ferramentas.



