Pular para o conteúdo
Tecnologia

O segredo para criar imagens melhores no ChatGPT e no Gemini

Criar imagens com inteligência artificial parece simples, mas bons resultados dependem de instruções claras. Alguns ajustes no prompt podem transformar completamente o que ChatGPT e Gemini entregam.
Por

Tempo de leitura: 4 minutos

Basta escrever algumas palavras e, em segundos, uma inteligência artificial transforma uma ideia em fotografia, ilustração ou desenho. Parece magia, mas quem já tentou criar uma imagem muito específica sabe que o resultado nem sempre corresponde ao que estava na cabeça. O problema, na maioria das vezes, não está na ferramenta, mas na maneira como o pedido foi formulado. Com alguns truques simples, ChatGPT e Gemini podem produzir imagens muito mais precisas e profissionais.

Um bom resultado começa antes de gerar a imagem

O segredo para criar imagens melhores no ChatGPT e no Gemini
© O segredo para criar imagens melhores no ChatGPT e no Gemini

Criar imagens com ChatGPT e Gemini é uma tarefa bastante intuitiva. Em geral, basta abrir uma conversa, selecionar a opção de geração de imagens e descrever o que deseja ver.

No entanto, existe uma diferença enorme entre pedir “um cachorro em uma praia” e descrever “um golden retriever correndo em uma praia vazia ao pôr do sol, fotografia realista, luz dourada e fundo levemente desfocado”.

Nos dois casos, a inteligência artificial entende o tema. Mas, no segundo, ela recebe informações suficientes para decidir menos por conta própria.

Esse é o principal segredo para obter resultados melhores: orientar a ferramenta sem transformar o prompt em um texto confuso ou cheio de instruções contraditórias.

O ideal é começar definindo o objetivo da imagem. Ela será usada em uma publicação de Instagram, em uma apresentação, em um blog ou apenas como ilustração pessoal? Essa decisão influencia a proporção, a composição e até o espaço disponível ao redor do elemento principal.

O que um bom prompt precisa informar

O segredo para criar imagens melhores no ChatGPT e no Gemini
© O segredo para criar imagens melhores no ChatGPT e no Gemini

Um prompt eficiente funciona como uma pequena ficha técnica da imagem.

O primeiro elemento deve ser o sujeito principal. Pode ser uma pessoa, um animal, um objeto, um edifício ou uma paisagem. Quanto mais clara for essa descrição, menores são as chances de a IA interpretar o pedido de maneira inesperada.

Depois, é importante indicar a ação. O sujeito está parado, caminhando, sorrindo, olhando para a câmera ou interagindo com algum objeto?

O ambiente também precisa ser definido. Uma pessoa em um escritório moderno produz um resultado muito diferente da mesma pessoa em uma floresta, em uma estação espacial ou diante de uma parede branca.

O estilo visual é outro elemento decisivo. A imagem pode ser fotorrealista, cinematográfica, em aquarela, desenho animado, arte vetorial, pixel art, anime ou pintura a óleo.

Também vale mencionar a iluminação. Termos como luz suave, iluminação dramática, luz de estúdio, pôr do sol ou ambiente noturno ajudam a IA a construir o clima correto.

Câmera, enquadramento e proporção fazem diferença

Muitos usuários descrevem apenas o conteúdo da imagem e esquecem de indicar como ela deve ser vista.

O ângulo da câmera muda completamente a sensação transmitida. Um personagem fotografado de baixo para cima pode parecer poderoso, enquanto uma imagem vista de cima tende a transmitir fragilidade ou ampliar a percepção do ambiente.

Também é possível pedir um plano fechado, mostrando apenas o rosto, um plano médio ou uma visão ampla da cena.

Termos comuns da fotografia, como profundidade de campo, lente grande angular, fundo desfocado ou fotografia macro, costumam ajudar a refinar o resultado.

A proporção da imagem também deve ser definida desde o início.

Uma composição vertical pode funcionar melhor para Stories e Reels, enquanto uma imagem horizontal em 16:9 é mais adequada para apresentações, vídeos ou capas de artigos. Já o formato quadrado costuma ser útil para publicações em redes sociais.

Informar esse detalhe evita que elementos importantes sejam cortados posteriormente.

Dizer o que não deve aparecer também ajuda

Outro recurso útil é indicar elementos indesejados.

O usuário pode pedir uma imagem sem textos, logotipos, marcas d’água, pessoas ao fundo ou objetos específicos. Isso reduz o risco de a inteligência artificial acrescentar detalhes que prejudiquem a composição.

Ainda assim, é preferível estruturar o pedido de forma positiva sempre que possível.

Em vez de escrever apenas “não faça um fundo poluído”, por exemplo, pode ser mais eficiente pedir “fundo minimalista, limpo e com poucos elementos”.

Quando a imagem precisa incluir palavras, o ideal é colocar o texto desejado entre aspas e explicar onde ele deve aparecer. Mesmo assim, letras continuam sendo uma das áreas em que geradores de imagem podem cometer erros, tornando necessária uma revisão cuidadosa.

Prompts enormes nem sempre produzem imagens melhores

Detalhamento não significa escrever vários parágrafos.

Um prompt muito extenso pode conter informações repetidas, incompatíveis ou pouco importantes, dificultando a interpretação do modelo.

O melhor caminho é organizar as instruções em uma ordem lógica: sujeito, ação, ambiente, estilo, iluminação, enquadramento e proporção.

Um exemplo seria: “Astronauta caminhando por uma cidade abandonada, cenário noturno, estilo cinematográfico realista, luzes de néon refletindo no chão molhado, plano aberto, composição horizontal em 16:9, sem textos”.

Essa estrutura fornece bastante informação sem sobrecarregar a ferramenta.

A primeira imagem não precisa ser a definitiva

Um dos erros mais comuns é esperar que a criação fique perfeita na primeira tentativa.

ChatGPT e Gemini permitem continuar a conversa e solicitar mudanças sobre a imagem já produzida. É possível trocar o fundo, ajustar a iluminação, reposicionar personagens, remover objetos, alterar o estilo ou mudar a proporção.

Em projetos mais complexos, costuma ser melhor gerar primeiro uma composição básica e aperfeiçoá-la em etapas.

Também é possível utilizar uma imagem de referência para mostrar cores, enquadramento, roupas, objetos ou atmosfera desejados. Isso reduz a necessidade de explicar tudo apenas por texto.

No fim, gerar boas imagens com inteligência artificial envolve tentativa, correção e refinamento. Quanto mais claro for o diálogo com a ferramenta, menor será a distância entre a ideia imaginada e o resultado exibido na tela.

[Fonte: Hipertextual]

Partilhe este artigo

Artigos relacionados