A OpenAI lançou o ChatGPT Images 2.5 com geração mais rápida, maior fidelidade visual e novas formas de controlar edições.
A principal novidade para quem usa o celular é o Sketch, ferramenta que permite fazer um rabisco diretamente no ChatGPT e transformar esse desenho em uma imagem completa.
O novo modelo já está disponível para usuários do ChatGPT, ChatGPT Work e Codex em computadores, celulares e web. No ChatGPT, a disponibilidade alcança todos os planos.
Sketch transforma um desenho simples em referência para a IA
No celular, o usuário pode abrir o recurso de Sketch, desenhar a ideia e complementar o rabisco com uma descrição em texto. A imagem final usa os dois elementos como referência.
Isso ajuda em situações nas quais é difícil explicar apenas com palavras onde cada objeto deve ficar.
Um esboço pode indicar, por exemplo, a posição de móveis em um cômodo, o formato de uma peça de roupa ou a composição geral de uma cena.
Além do Sketch, o Images 2.5 adiciona outras ferramentas:
- comentários diretamente na imagem para indicar áreas que precisam de mudança;
- modelos prontos para formatos como flyers e fotos de produtos;
- compartilhamento do prompt usado em uma criação;
- melhor preservação de pessoas e objetos durante edições sucessivas.
OpenAI promete até 50% menos latência na geração
A empresa afirma ter reduzido em até 50% a latência em comparação com o Images 2.0.
O modelo também busca gerar iluminação mais natural, texturas mais ricas e detalhes mais consistentes ao longo de várias alterações na mesma imagem.
Na prática, a mudança tenta resolver um problema comum das ferramentas generativas: o usuário pede uma pequena edição e a IA modifica partes que deveriam continuar iguais.
A OpenAI diz que o Images 2.5 segue instruções de edição com mais precisão e mantém melhor a identidade dos elementos de referência.
Os limites de geração existentes no ChatGPT não mudaram com a atualização. Portanto, a quantidade de imagens disponível continua dependendo das regras do plano e do produto utilizado.
API também recebe dois novos modelos de imagem
Desenvolvedores ganharam duas opções.
- O GPT-Image-2.5 Flare leva as melhorias de qualidade, edição e velocidade para a API;
- O GPT-Image-2.5 Sunburst prioriza precisão em trabalhos detalhados e pode levar mais tempo para gerar o resultado.
A OpenAI também mantém mecanismos de procedência para imagens criadas por suas ferramentas, incluindo metadados C2PA e marcações invisíveis.
A empresa diz que o novo modelo herda as proteções usadas na geração anterior.
Para o usuário comum, porém, a mudança mais visível está no fluxo de edição:
- agora é possível combinar texto, rabisco e comentários visuais sem sair do ChatGPT, o que reduz a necessidade de reescrever prompts longos para explicar uma alteração simples.
O que você achou? Siga @bitmagazineoficial no Instagram para ver mais e deixar seu comentário clicando aqui
