# Texto em imagens de IA: porque falha e como obter letras limpas

[Canonical HTML page](https://gradiently.design/pt-pt/guide/ai-text-in-images)

A imagem é linda. A placa nela diz ABERTP TODOS OS DAIS. Eis porque é que os geradores de imagens ainda tropeçam nas letras e a mudança simples de método que acaba com o problema.

## The short version

- O texto em imagens de IA falha porque os geradores de imagens desenham as letras como formas feitas de píxeis em vez de escreverem caracteres.
- Os modelos de imagem mais recentes tratam muito melhor palavras curtas e grandes do que os antigos, mas frases longas, letra miúda e nomes pouco comuns continuam a falhar com frequência.
- O texto dentro de uma imagem gerada não pode ser editado, traduzido nem lido de forma fiável por leitores de ecrã.
- O método fiável é gerar a imagem sem texto e acrescentar as palavras depois como uma camada de texto real.
- Pedir ao gerador um espaço calmo e vazio onde vão ficar as palavras torna o texto muito mais fácil de ler.

O **texto em imagens de IA** falha porque um gerador de imagens não escreve. Pinta píxeis que se parecem estatisticamente com letras, aprendidas a partir de um número enorme de imagens, e por isso pode produzir um O convincente seguido de um N ligeiramente errado. As palavras curtas em letras grandes saem agora muitas vezes certas; as frases longas, a letra miúda e os nomes normalmente não. A correção fiável é deixar de pedir texto na imagem: gera a imagem sem palavras e depois acrescenta-as como texto real e editável.

## Porque é que os geradores de imagens erram as letras

Um modelo de texto trabalha com palavras e caracteres. Um modelo de imagem trabalha com píxeis. Quando pedes uma placa de café que diga “Aberto todos os dias”, o modelo de imagem tem de desenhar as formas dessas letras pela ordem certa sem nada que verifique a ortografia. Já viu inúmeras placas e por isso sabe mais ou menos como é uma, e é por isso que o resultado costuma estar perto mas errado num ou dois sítios.

- **Desenha, não soletra.** Não há nenhum passo em que cada letra seja confrontada com a palavra que pediste.
- **O texto pequeno tem píxeis a menos** para o modelo acertar nos pormenores de cada letra.
- **As frases mais longas multiplicam o risco.** Cada letra a mais é mais uma oportunidade de erro.
- **As palavras e nomes pouco comuns** aparecem raramente nas imagens de treino, por isso o modelo tem menos em que se basear.
- **Os tipos de letra são aproximados.** Podes pedir uma serifa, mas não o tipo de letra da tua marca.

## O que melhorou e o que ainda falha

Os modelos recentes são muito melhores com texto do que os de há alguns anos. Uma só palavra a negrito num cartaz sai muitas vezes bem escrita à primeira. Esse progresso é real, mas muda as probabilidades e não o método, e não resolve os problemas que vêm de o texto fazer parte da imagem.

| Tarefa | Texto gerado | Camada de texto real |
| --- | --- | --- |
| Uma palavra grande e comum | Muitas vezes certa | Sempre certa |
| Uma frase completa | Tem erros com frequência | Sempre certa |
| Letra miúda, datas, preços | Pouco fiável | Sempre certa |
| O tipo de letra da tua marca | Aproximado, no máximo | Exato |
| Mudar uma palavra mais tarde | Gerar de novo | Clicar e escrever |
| Traduzir para outra língua | Gerar de novo | Trocar o texto |
| Lido por um leitor de ecrã | Só através do texto alternativo | Pode ser texto real em HTML ou PDF |

O texto gerado é uma aposta que melhora de ano para ano. Uma camada de texto é uma certeza que não precisa de melhorar.

## Como obter letras limpas sempre

Separa as tarefas. Deixa o gerador fazer a imagem e deixa uma ferramenta de design tratar das palavras. É assim que os designers profissionais sempre trabalharam com fotografias, e serve igualmente bem para imagens de IA. A diferença entre os dois tipos de ferramenta está explicada em [geradores de imagens com IA ou ferramentas de design](https://gradiently.design/pt-pt/guide/ai-image-generator-vs-design-tool).

1. **Pede sem texto** Junta uma linha como “sem texto, sem letras, sem sinalética, sem logótipos” a todos os pedidos de imagem.
2. **Pede espaço** Descreve onde vão ficar as palavras: “mantém o terço superior calmo e desimpedido” ou “deixa céu limpo à esquerda”.
3. **Gera na proporção certa** Pede o formato que vais usar, como 4:5 para um post de 1080×1350 ou 16:9 para uma miniatura de 1280×720.
4. **Acrescenta as palavras como texto** Coloca a imagem numa ferramenta de design e compõe o título num tipo de letra verdadeiro. [Tipos de letra para redes sociais](https://gradiently.design/pt-pt/guide/fonts-for-social-media) ajuda-te a escolher.
5. **Verifica o contraste onde ficam as palavras** O contraste muda ao longo de uma imagem, por isso verifica a zona exata atrás de cada linha.

```text
Luz da manhã sobre um porto tranquilo, céu pastel, barcos pequenos no terço inferior.
A metade superior é céu aberto sem detalhes, adequada para um título.
Sem texto, letras, números, placas, logótipos nem marca d’água.
Proporção 9:16.
```

Um pedido de imagem que prevê o texto. O céu aberto passa a ser o lugar das palavras.

## Fazer as palavras lerem-se em qualquer fundo

Acrescentar o texto como camada resolve a ortografia. Não resolve automaticamente a legibilidade, porque um fundo carregado ou irregular ainda pode engolir as palavras. As soluções habituais são mover o texto para uma zona mais calma, escurecer ou clarear a imagem por trás dele ou escolher um peso mais forte. [Texto legível sobre fotografias](https://gradiently.design/pt-pt/guide/readable-text-on-photos) e [texto sobre fundos carregados](https://gradiently.design/pt-pt/guide/type-on-busy-backgrounds) tratam as técnicas em pormenor.

Um post vertical com o texto Aberto todos os dias às 8h em que o fundo carregado dificulta a leitura de parte da linha

Texto real, bem escrito, mas o fundo atravessa-o e a linha desfaz-se.

O mesmo post com uma zona do fundo mais calma e de maior contraste atrás das palavras, que se leem com clareza

As mesmas palavras com o fundo a abrir espaço: mais calmo e com mais contraste atrás de cada letra.

O Gradiently foi feito para a versão da direita. As palavras são sempre texto real e um Mark sabe onde estão: a sua região mais calma e de melhor contraste desloca-se para trás do texto, as cores junto às letras aprofundam-se ou clareiam, e a Tinta automática escolhe letra clara ou escura para cada linha a partir da paleta do próprio Mark. Não há caixas, sombras nem desfocagem, e tu escolhes com que intensidade o fundo responde. O método por trás disto está explicado em [texto sobre gradiente](https://gradiently.design/pt-pt/guide/text-on-gradient).

## Se já tens uma imagem com texto mau

### Tentador mas arriscado

- Voltar a gerar até a ortografia sair certa
- Editar letras soltas à mão num editor de fotografia
- Deixar assim e esperar que ninguém repare
- Acrescentar mais palavras para tapar o erro

### Fiável

- Remover ou tapar a zona do texto gerado
- Usar a imagem apenas como fundo
- Compor de novo as palavras como camada de texto
- Manter o texto fora das zonas mais carregadas

A maioria dos editores de imagem consegue remover uma pequena zona de texto e preenchê-la a partir do que a rodeia. Depois de as letras más desaparecerem, trata a imagem como fundo e acrescenta as palavras como deve ser. Depois escreve o texto alternativo, porque os leitores de ecrã não leem palavras que só existem como píxeis; [contraste de cor e acessibilidade](https://gradiently.design/pt-pt/guide/color-contrast-accessibility) trata do resto do essencial da acessibilidade.

## FAQ

### Porque é que a IA erra a ortografia das palavras nas imagens?

Os geradores de imagens desenham as letras como formas de píxeis aprendidas a partir de imagens. Nada verifica cada letra contra a palavra que pediste, por isso entram erros de ortografia, sobretudo em texto longo ou pequeno.

### Que gerador de imagens com IA é melhor com texto?

Os modelos mais recentes tratam muito melhor palavras curtas e grandes do que os antigos, mas nenhum é totalmente fiável com frases, letra miúda ou nomes. Acrescentar o texto depois como camada real funciona sempre.

### Como acrescento texto a uma imagem de IA?

Gera a imagem sem texto e com espaço calmo onde vão ficar as palavras, depois coloca-a numa ferramenta de design e compõe as palavras como texto editável.

### Posso editar o texto numa imagem gerada por IA?

Não como texto. Podes remover a zona num editor de imagem e compor palavras novas por cima, mas as letras originais são píxeis, não caracteres.
