IA de texto para imagem

Crie e edite imagens com base em textos sem escrever uma linha sequer de código

Gere e edite imagens com base em descrições de texto em segundos usando os modelos de geração de imagens Gemini 3 Pro Image e Imagen com APIs disponíveis nas linguagens de programação Python, Java e Go. 

Clientes novos ganham até US$ 300 em créditos para gerar imagens e muito mais na plataforma de agentes do Gemini Enterprise.

Visão geral

O que é a IA de texto para imagem?

A IA de texto para imagem é um tipo de inteligência artificial capaz de gerar e editar imagens a partir de descrições de texto. Essa tecnologia tem o potencial de mudar a forma como criamos e interagimos com os conteúdos visuais. As ferramentas e os recursos de conversão de texto em IA do Google Cloud, incluindo modelos de IA pré-treinados, como Imagen, Gemini 3 Pro e Veo, disponíveis na Plataforma de Agentes, foram projetados para ajudar os desenvolvedores a implementar facilmente a geração de texto para imagem nos seus aplicativos.

Como a conversão de texto em imagem é usada no desenvolvimento de aplicativos?

A IA de texto para imagem pode ser usada no desenvolvimento de aplicativos para gerar maquetes, protótipos, ilustrações, dados de teste, conteúdo educacional e visualizações para depuração. A Plataforma de Agentes e a API Cloud Vision do Google Cloud oferecem aos desenvolvedores acesso a um pacote de recursos de processamento de imagens, incluindo detecção de texto, detecção de objetos e classificação de imagens.A Document AI pode ser usada para extrair texto de documentos digitalizados e gerar imagens descritivas de texto.

Como posso usar esses modelos do Google?

É possível acessar esses modelos de IA de conversão de texto em imagem usando a Agent Platform no Google Cloud ou o Google AI Studio.Para usar os modelos, basta fornecer um comando de texto, selecionar parâmetros (alguns modelos permitem selecionar parâmetros que controlam o estilo, a criatividade e a precisão da imagem gerada) e, por fim, gerar a imagem. 

Como funciona

A IA de texto em imagem usa o processamento de linguagem natural (PLN) para converter a descrição do texto em um formato legível por máquina. Depois de convertido para um formato legível por máquina, o modelo de machine learning é treinado com um enorme conjunto de dados de texto e imagens, aprende a identificar padrões e os usa para gerar ou editar imagens.

Interface de produto de IA generativa
Do texto à visão: uma introdução à geração de imagens por IA
Usos comuns

Gere imagens usando a IA

Gerar imagens usando solicitações de texto

Saiba como usar o recurso de geração de texto para imagem do Imagen na Plataforma de Agentes e exportar uma versão aprimorada de uma imagem gerada. Neste guia de início rápido, mostramos como usar a geração de imagens do Imagen no console do Google Cloud.

imagens criadas com o imagen
Gerar imagens usando solicitações de texto

Saiba como usar o recurso de geração de texto para imagem do Imagen na Plataforma de Agentes e exportar uma versão aprimorada de uma imagem gerada. Neste guia de início rápido, mostramos como usar a geração de imagens do Imagen no console do Google Cloud.

imagens criadas com o imagen

Editar imagens com IA

Fusão de várias imagens e edição conversacional

Com o Gemini, você pode combinar diferentes imagens em um novo visual perfeito. Use várias imagens de referência para criar uma única imagem unificada. Você também pode editar imagens com instruções simples em linguagem natural. Remova uma pessoa de uma foto em grupo ou corrija um pequeno detalhe, como uma mancha, com uma conversa simples.

Além disso, o Imagen na plataforma de agentes permite editar imagens geradas pelo Imagen ou imagens atuais. É possível especificar parte da imagem a ser modificada, além de uma descrição em texto das atualizações (edição da base de máscara)

Fusão de várias imagens e edição conversacional

Com o Gemini, você pode combinar diferentes imagens em um novo visual perfeito. Use várias imagens de referência para criar uma única imagem unificada. Você também pode editar imagens com instruções simples em linguagem natural. Remova uma pessoa de uma foto em grupo ou corrija um pequeno detalhe, como uma mancha, com uma conversa simples.

Além disso, o Imagen na plataforma de agentes permite editar imagens geradas pelo Imagen ou imagens atuais. É possível especificar parte da imagem a ser modificada, além de uma descrição em texto das atualizações (edição da base de máscara)

Legendas visuais com IA

Veja descrições de imagens usando legendas visuais

Gere descrições relevantes para imagens, incluindo metadados detalhados, legendagem automática e descrições rápidas de produtos e recursos visuais.

Interface do produto de legenda de imagem
Veja descrições de imagens usando legendas visuais

Gere descrições relevantes para imagens, incluindo metadados detalhados, legendagem automática e descrições rápidas de produtos e recursos visuais.

Interface do produto de legenda de imagem

Comece sua prova de conceito

Novos clientes ganham até US$ 300 em créditos para gerar imagens e muito mais na plataforma de agentes

Tem um projeto grande?

Saiba que tipos de imagens você pode criar

Saiba como gerar imagens usando comandos de texto

Teste o Imagen no Colab

Google Cloud