Como evitar texto em imagem gerada por IA: o que aprendemos em 24 capas
Voltar para o Blog
Artigointeligência artificialautomaçãotecnologia

Como evitar texto em imagem gerada por IA: o que aprendemos em 24 capas

Mafra8 de outubro de 20265 min de leitura

Pedir "sem texto" no prompt não impede o gerador de imagem de escrever. A gente aprendeu isso gerando a capa de cada artigo deste blog com IA: em 24 rodadas registradas entre 3 de setembro e 8 de outubro de 2026, 11 capas saíram na primeira tentativa com letras, números ou glifos que parecem escrita, todas com "no text" no prompt. O que resolveu não foi insistir na frase. Foi parar de pedir os objetos que carregam texto.

Por que a IA coloca texto na imagem mesmo quando você pede "sem texto"?

Porque o objeto que você pediu vem com texto junto. Terminal tem código, placa tem palavra, rack de servidor tem rótulo, fundo "hacker" tem dígito binário. O modelo desenha a versão típica do objeto, e a versão típica tem escrita.

Nos 10 casos em que o nosso log anotou onde estava o texto, ele estava sempre num desses lugares:

  • terminal ou editor com código (if/else legíveis, um $ git commit inteiro)
  • monitor com padrão que lembra escrita árabe ou coreana
  • placa: pedimos um "dead-end signpost" e veio escrito DEAD-END
  • rack de servidor com "GPU" pintado
  • balões de diff com + e -
  • fundo de dados com "data packet" escrito, ou sequência 1010110

A gente usa o Nano Banana 2 do Gemini (nano-banana-2), em 16:9 e resolução 2K. A regra vale para qualquer gerador que aprendeu com imagens da internet: a cena que você descreve puxa os detalhes que costumam vir com ela.

O que mudou no número de capas refeitas?

Caiu de 11 em 12 para 2 em 12, depois que passamos a trocar o objeto em vez de reforçar a proibição. Os números vêm do nosso registro de execuções, uma linha por artigo publicado:

PeríodoRodadas com resultado da capa registradoRefeitas por texto ou glifoRefeitas só pela cor do mascoteCertas na 1ª tentativa
3 a 26 de setembro12921
27 de setembro a 8 de outubro122010

Leia com cuidado: é registro de operação, não experimento controlado. O que sustenta a leitura é que as 2 falhas do segundo período foram exatamente os dois objetos que ainda estavam no prompt: um terminal com código (saiu if/else) e um fundo de "matriz" (saiu 1010110).

Capa gerada por IA com uma tela de código cheia de glifos que imitam programação
1ª geração: o prompt pedia uma tela de código. Veio uma tela cheia de glifos que imitam código.
Mesma capa com a tela de código trocada por barras horizontais abstratas
Versão publicada: a mesma cena, com o código trocado por barras abstratas.

Como escrever o prompt para não sair texto?

Troque cada objeto que carrega escrita por um substituto abstrato, e feche o prompt com uma proibição ampla. A tabela que a gente usa hoje:

Em vez de pedirPeça
terminal ou editor com códigoterminal window filled only with abstract colored horizontal bars, no code symbols
fundo de matriz ou binárioplain dark gradient background with soft glowing dots, no binary digits, no 0s or 1s
placa, rótulo, balão com conteúdoo objeto sem superfície de escrita: seta, ícone, balão vazio
rack ou painel com nomeserver rack with blinking lights only, no labels

O esqueleto completo, pronto para copiar:

Dynamic cartoon illustration, dark navy to deep purple gradient background
with soft glowing dots.
[SUA CENA, descrita só com formas: barras, blocos, ícones, molduras vazias]
Plain background, no screens with code, no signs, no labels.
Absolutely no letters, numbers, words, code, glyphs or symbols anywhere in the image.

A capa deste artigo saiu com esse esqueleto na primeira tentativa: duas molduras com formas geométricas, uma lupa, uma borracha e um ícone de check. É um caso só e não prova nada sozinho; o que pesa é a tabela acima.

Precisa conferir a imagem mesmo com o prompt certo?

Precisa, e em tamanho cheio, olhando o fundo e os cantos. A nossa checagem já era obrigatória antes de subir a capa, e mesmo assim deixou passar uma: a capa de um tutorial publicado em 14 de setembro tem dígitos binários no canto superior direito. O registro daquela rodada não menciona nada, porque a checagem olhou a cor do mascote e parou ali.

A lista que usamos agora antes de subir qualquer capa:

  1. Abrir o PNG em tamanho cheio, não a miniatura.
  2. Varrer os quatro cantos e o fundo atrás do personagem.
  3. Olhar telas, painéis e balões: glifo que "parece" letra conta como texto.
  4. Conferir a cor do mascote. Duas capas saíram com ele branco e uma com ele rosa.
  5. Achou texto? Não reforce a proibição. Descubra qual objeto trouxe o texto e troque por um substituto da tabela.

Dá para automatizar essa checagem?

Ainda não com confiança, pelo menos não do jeito que tentamos. Escrevemos um script que mede a proporção de pixels na cor do mascote e rodamos contra as 44 capas que temos em disco: ele reprovou uma capa em que o mascote estava roxo, só pequeno, e aprovou as duas capas que o nosso registro marca como mascote rosa. Descartamos. Para texto, o caminho natural é OCR, mas glifo que imita escrita é justamente o que OCR não lê como letra. Por enquanto a checagem é visual, com a lista acima.

Se você automatiza esse tipo de fluxo com um agente de programação e não quer contar token a cada nova tentativa, a Verboo Code oferece tokens ilimitados.

Gostou deste artigo?
Compartilhe conhecimento com sua rede.
// Leia também

Artigos relacionados