OpenAI tornou suas ofertas de geração de imagens mais precisas e consistentes em suas últimas atualizar para ChatGPT Imagens, à medida que mais empresas e marcas usam a geração de imagens de IA para ajudar na visualização de design.
As atualizações serão enviadas para todos os usuários do ChatGPT e a API como GPT Image 1.5. A empresa disse que é alimentados por GPT 5.2, que muitos usuários antigos descobriram ser uma atualização poderosa para casos de uso de negócios.
"A primeira experiência de muitas pessoas com o ChatGPT envolve transformar um pedido de texto em uma foto", disse Fidji Simo, CEO da OpenAI de Aplicações, num post Substack. "É uma maneira mágica de ver o que essa tecnologia pode fazer, mas a interface de chat não foi originalmente projetada para isso. Criar e editar imagens é um tipo diferente de tarefa e merece um espaço construído para visuais."
Atualizações amigáveis ao negócio em edição e instruções precisas seguindo
Uma das maiores atualizações para o ChatGPT Images é a edição mais direcionada, mesmo quando a imagem é gerada na plataforma de chat em vez de através da API. Modelos de geração de imagens como o ChatGPT Images, o Nano Banana do Google, e ajustes rápidos baseados na difusão estável para imagens feitas por IA, onde o usuário pode identificar partes específicas da foto para mudar. Mas essas características podem, por vezes, ser atropeladas.
Com a atualização, OpenAI disse que o modelo adere melhor ao que o usuário quer "enquanto mantém elementos como iluminação, composição e aparências das pessoas consistentes entre entradas, saídas e edições subsequentes."
Os usuários podem instruir o modelo a fazer a maioria dos tipos de edição de imagem, como adicionar ou subtrair um elemento, combinar, misturar e transpor.
O OpenAI disse que este modelo "segue instruções de forma mais confiável" do que as versões anteriores. Também é capaz de tornar o texto melhor e gerar letras reais, legíveis, mesmo quando estas são mais densas ou menores. O OpenAI atualizou o modelo para criar rostos melhores e menores em fotos com um grande grupo de pessoas.
"Essas transformações funcionam para conceitos simples e mais complexos, e são fáceis de tentar usar estilos e ideias predefinidos no novo recurso ChatGPT Images — não é necessário nenhum aviso escrito", de acordo com OpenAI.
Batalha dos geradores de imagem
Atualização do modelo de imagem do OpenAI vem após Google muito elogiado Nano Banana Pro modelo de imagem, que atraiu elogios da comunidade desenvolvedora.
A empresa deve competir com outros modelos de geração de imagens em constante crescimento que visam atrair mais usuários corporativos. E não é apenas com o Google que o OpenAI tem que lidar. Em agosto, Alibaba anunciou que Qwen-Image pode renderizar texto legível em chinês e inglês. Black Forest Labs lançado Fluxo.2, que também oferece um modelo de imagem robusto e de código aberto.



