O DALL-E é o modelo de geração de imagens da OpenAI. A versão mais conhecida, o DALL-E 3, foi lançada em outubro de 2023 e ficou popular por sua precisão ao interpretar prompts em linguagem natural. Em março de 2025, a OpenAI substituiu o DALL-E 3 pelo GPT Image 1.5 dentro do ChatGPT, e em abril de 2026 lançou o GPT Image 2 — a versão atual, com resolução nativa de até 4K, faixa de proporção muito mais ampla e precisão de texto acima de 99% em palavras curtas. O DALL-E 3 foi removido da API da OpenAI em maio de 2026.

Na prática para quem usa o ChatGPT: a interface não mudou. Você continua descrevendo o que quer e a imagem aparece na conversa. O que mudou foi o modelo por baixo — e para melhor, especialmente em texto dentro de imagens, resolução e edição conversacional. Para quem prefere uma opção gratuita, o Microsoft Copilot ainda oferece acesso ao DALL-E 3 sem custo.

Este artigo cobre o estado atual (2026): o que mudou, como usar, quais planos valem a pena e quando escolher a OpenAI em vez do Midjourney ou do Meta AI.


O que você precisa para começar

Via ChatGPT:

  • Conta na OpenAI (gratuita para criar em chatgpt.com)
  • Plano Free dá acesso a 2–3 imagens por dia
  • Plano Plus ($20/mês) dá ~50 imagens a cada 3 horas

Via Microsoft Copilot (gratuito):

  • Conta Microsoft (gratuita)
  • Acesso em copilot.microsoft.com
  • 15 gerações rápidas por dia, depois velocidade mais lenta

Via API (desenvolvedores):

  • Chave de API da OpenAI
  • O modelo atual é gpt-image-2 — DALL-E 3 foi descontinuado em maio de 2026

Planos do ChatGPT e limites de imagem (junho 2026):

PlanoPreçoLimite de imagens
FreeGratuito~2–3 por dia
GoUS$ 8/mês~20–30 por dia
PlusUS$ 20/mês~50 a cada 3 horas
ProUS$ 200/mêsIlimitado

A OpenAI não publica os números oficialmente — os valores acima são baseados em relatos de usuários e análises independentes. O plano Plus é o ponto de equilíbrio para uso regular.


Passo a passo: primeiros 10 minutos no ChatGPT

1. Acesse o ChatGPT

Entre em chatgpt.com com sua conta. No menu de modelos (topo da tela), confirme que está usando GPT-4o ou superior — esses modelos incluem geração de imagens nativamente. No plano gratuito, a geração pode não aparecer se você já atingiu o limite do dia.

2. Peça a imagem em linguagem natural

Diferente do Midjourney, você não precisa de comandos especiais. Basta descrever:

“Cria uma foto de um café parisiense ao entardecer, mesas na calçada, luzes quentes, estilo fotografia de rua”

A imagem aparece diretamente na conversa. Uma imagem por vez — não vem uma grade de 4 opções como no Midjourney.

3. Edite conversacionalmente

Esta é a principal vantagem do GPT Image 2 sobre o DALL-E 3: você pode pedir mudanças cirúrgicas sem regenerar a imagem inteira.

“Muda a cor das cadeiras para vermelho”

“Adiciona um guarda-chuva azul sobre a mesa da esquerda”

“Escurece o fundo, como se fosse noite”

O modelo mantém o contexto da conversa e tenta preservar os elementos que não foram pedidos para mudar. Na prática, funciona bem para ajustes de cor, adição de elementos e mudanças de iluminação. Mudanças estruturais (alterar a composição toda) ainda geram resultados imprevisíveis.

4. Baixe a imagem

Passe o mouse sobre a imagem gerada. Vai aparecer um botão de download no canto. A imagem é salva em PNG.


Como usar via Microsoft Copilot (gratuito)

O Copilot em copilot.microsoft.com ainda usa o DALL-E 3 — o modelo anterior, que a OpenAI mantém disponível através da Microsoft mesmo após descontinuá-lo na API própria.

Por que usar o Copilot em vez do ChatGPT Free:

  • 15 gerações rápidas por dia (mais do que o ChatGPT Free)
  • Sem anúncios no plano básico
  • Gera 4 variações por prompt (o ChatGPT Free gera 1)

Limitação real: o DALL-E 3 via Copilot não tem edição conversacional — cada prompt é independente, sem memória do anterior.

Para acessar: entre no Copilot, clique no ícone de imagem na barra de prompt, descreva o que quer e gere.


Como escrever prompts que funcionam

O GPT Image 2 interpreta linguagem natural melhor do que qualquer versão anterior do DALL-E, e segue instruções com múltiplas restrições no mesmo prompt com mais consistência. Você não precisa aprender uma sintaxe especial — mas alguns ajustes fazem diferença. O guia de prompts para IA cobre as técnicas em profundidade.

Estrutura básica

[sujeito] + [contexto] + [estilo visual] + [iluminação]

Fraco:

“Um cachorro na praia”

Forte:

“Um labrador dourado correndo na beira do mar, areia molhada, pôr do sol alaranjado, fotografia de natureza, perspectiva baixa”

Texto dentro das imagens

Esta é a área onde o GPT Image 2 mais evoluiu: a OpenAI reporta mais de 99% de precisão em textos curtos. Para texto legível, use aspas e seja específico:

“Cria uma capa de livro com o título “Guia de Fotografia” em letras grandes e brancas, fundo azul escuro, fonte sans-serif moderna”

Palavras curtas (1–4 palavras) saem praticamente perfeitas. Frases longas em lugares visíveis também funcionam bem, com menos variação entre gerações do que na versão anterior — mas texto muito extenso ainda tem taxa de erro maior.

Controlando o estilo

O modelo entende referências de estilo diretas:

  • fotografia documental, câmera analógica, grão de filme
  • ilustração editorial, cores planas, traço limpo
  • aquarela suave, cores pastel, fundo branco
  • render 3D, iluminação de estúdio, minimalista
  • fotografia de produto, fundo branco, luz difusa

Técnicas intermediárias

Iteração com precisão

Com o GPT Image 2, a abordagem mais eficiente é construir a imagem em camadas:

  1. Gere a composição base com o prompt principal
  2. Ajuste elementos específicos: "Muda apenas a cor do céu para rosado"
  3. Refine detalhes: "Torna a expressão do personagem mais séria"
  4. Ajuste técnicos: "Aumenta o contraste, deixa mais cinematográfico"

Cada pedido cirúrgico preserva melhor o que estava bom do que regenerar do zero.

Referências de imagem

Você pode enviar uma foto existente e pedir variações:

  • "Cria uma versão ilustrada desta foto no estilo cartoon"
  • "Recria esta cena ambientada nos anos 1950"
  • "Adapta esta composição para formato vertical"

O modelo não replica rostos de pessoas reais para outras cenas (filtro de privacidade), mas usa cor, composição e estilo da imagem enviada.

Proporções

Por padrão, as imagens saem em formato quadrado. Para mudar, peça explicitamente — o GPT Image 2 aceita uma faixa bem mais ampla que a versão anterior, de 3:1 (bem panorâmico) a 1:3 (bem vertical):

  • "Cria em formato horizontal, 16:9" — ideal para banners e wallpapers
  • "Cria em formato vertical, 9:16" — ideal para stories e reels
  • "Cria em formato quadrado" — padrão para posts
  • "Cria em formato bem panorâmico, tipo capa de site" — proporções ultra-largas agora são suportadas nativamente

Veja o guia de aspect ratio em imagens com IA para a sintaxe de proporção de outras ferramentas.


Técnicas avançadas

Para designers e criadores de conteúdo

O GPT Image 2 é especialmente forte para fotografia de produto — fundo branco, luz de estúdio, múltiplos ângulos. Fluxo que funciona bem:

  1. Envie uma foto do produto real
  2. Peça: "Recria este produto com fundo branco limpo, iluminação de estúdio profissional, sem sombras duras"
  3. Varie: "Agora com fundo preto e iluminação dramática lateral"

Para identidade visual, o texto legível e os elementos geométricos precisos são um diferencial real sobre o Midjourney.

Múltiplas imagens numa geração só

Uma novidade do GPT Image 2: ao usar um modelo com raciocínio (thinking/pro) no ChatGPT, dá para pedir várias imagens coordenadas de uma vez, mantendo o mesmo personagem ou objeto entre elas — por exemplo, pedir o mesmo produto em três ângulos diferentes, ou o mesmo post em três proporções (quadrado, story, banner) numa única resposta, em vez de gerar uma por uma.

Uso via API (GPT Image 2)

Para desenvolvedores, o modelo atual na API da OpenAI é gpt-image-2, com resolução configurável em três níveis:

  • 1K — mais rápido e barato
  • 2K — equilibrado, resolução nativa no ChatGPT
  • 4K — maior qualidade e detalhes (verificar disponibilidade — listado como beta em parte da documentação)

O DALL-E 3 foi removido da API em maio de 2026 e não está mais disponível para chamadas programáticas.


Limitações e problemas comuns

Ainda não é uma grade automática como o Midjourney. Por padrão, o ChatGPT gera uma imagem por vez. O modo com raciocínio permite pedir várias de uma vez com continuidade entre elas, mas não é o comportamento padrão — se quiser variações, ainda é preciso pedir explicitamente: "Agora gera 3 versões diferentes desta cena".

Textura de pele artificial. Em retratos próximos, o modelo ainda pode produzir uma textura de pele que parece artificial — o chamado “efeito cera”, menos frequente que nas versões anteriores mas não eliminado. Workaround: adicionar "skin texture, natural pores, realistic skin" ao prompt, ou pedir "estilo fotografia documental" em vez de "fotografia profissional".

Consistência de personagem entre conversas diferentes. Dentro da mesma conversa (ou numa mesma geração multi-imagem), o GPT Image 2 mantém continuidade bem melhor que a versão anterior. Mas ao abrir uma conversa nova, não existe um mecanismo de “character lock” que preserve o mesmo personagem automaticamente.

Filtros de conteúdo restritivos. Os filtros da OpenAI são conservadores. Imagens com violência, nudez, figuras públicas em contextos específicos e certas representações políticas são bloqueadas. Isso limita casos de uso profissionais em determinadas áreas.

Plano Free com limite baixo. 2–3 imagens por dia é pouco para explorar a ferramenta de forma produtiva. O plano Go ($8/mês) já oferece uma quantidade mais razoável para uso casual.


Quando usar a OpenAI vs alternativas

Use ChatGPT (GPT Image 2) quando:

  • Precisa de texto legível dentro da imagem
  • Quer editar partes específicas conversacionalmente
  • Trabalha com fotografia de produto
  • Já paga o ChatGPT Plus por outros motivos
  • Quer o modelo mais fácil de usar

Use Microsoft Copilot quando:

  • Quer uma alternativa gratuita com mais gerações que o ChatGPT Free
  • Prefere 4 variações por prompt (o Copilot ainda usa DALL-E 3 que gera grade)
  • Não quer pagar nada

Considere outras ferramentas quando:

  • Quer resultado artístico de alta qualidade → Midjourney
  • Quer gratuito via WhatsApp sem criar conta → Meta AI
  • Quer controle técnico total e sem limite de geração → Stable Diffusion

O comparativo Midjourney vs DALL-E aprofunda a escolha mais comum, critério por critério. E se a prioridade é não gastar nada, veja as melhores ferramentas gratuitas de IA para imagens.


FAQ

O DALL-E 3 ainda existe? Como produto de consumo, sim — o Microsoft Copilot ainda usa DALL-E 3. Dentro do ChatGPT, o modelo foi substituído pelo GPT Image 1.5 em março de 2025 e depois pelo GPT Image 2 em abril de 2026. Na API da OpenAI, o DALL-E 3 foi descontinuado em maio de 2026 e não está mais disponível para desenvolvedores.

Qual a diferença entre DALL-E 3 e GPT Image 2? O GPT Image 2 é significativamente melhor em texto dentro de imagens (mais de 99% de precisão em textos curtos), resolução (até 4K), faixa de proporção suportada e edição conversacional. O DALL-E 3 ainda gerava 4 variações por prompt; o GPT Image 2 gera uma imagem por vez por padrão, mas permite gerar várias imagens coordenadas de uma vez em modelos com raciocínio.

O ChatGPT gratuito gera imagens? Sim, mas com limite baixo — aproximadamente 2 a 3 imagens por dia. Após atingir o limite, o recurso fica indisponível até o próximo ciclo de 24 horas.

Dá para usar o DALL-E de graça sem o ChatGPT? Sim. O Microsoft Copilot (copilot.microsoft.com) oferece geração com DALL-E 3 gratuitamente, com boosts de geração rápida para usuários gratuitos (frequência exata não confirmada oficialmente — pode ser diária ou semanal, confira no próprio Copilot). Após esgotar o boost, as gerações ficam mais lentas mas continuam disponíveis.

O GPT Image 2 gera imagens em alta resolução? Sim — resolução nativa de 2K no ChatGPT, com 4K disponível via API. Para impressão em grande formato, ainda pode ser necessário fazer upscaling adicional com ferramentas externas dependendo do tamanho final.

Posso usar as imagens geradas comercialmente? Sim. Os termos de uso da OpenAI permitem uso comercial das imagens geradas por usuários pagantes. Confirme os termos atuais em openai.com/policies antes de usar em projetos de clientes ou venda.

Por que meu prompt em português às vezes gera texto em inglês dentro da imagem? O modelo foi treinado majoritariamente em inglês e pode inserir texto em inglês automaticamente. Para garantir português, especifique: com o texto "[sua frase]" escrito em português.


O GPT Image 2 é hoje o modelo da OpenAI mais avançado para criação de imagens via interface — com vantagens reais sobre as versões anteriores em texto, resolução e faixa de proporção suportada. Para uso casual, o plano gratuito do ChatGPT ou o Copilot resolvem. Para produção regular, o ChatGPT Plus ($20/mês) entrega volume suficiente. Se qualidade artística máxima for a prioridade, o Midjourney continua sendo a referência do setor.