A prévia de imagens do Gemini 2.5 Flash é compatível com vários tipos de edição de imagens.
Edição de imagens
O pré-lançamento público do Gemini 2.5 Flash Image para geração de imagens
(gemini-2.5-flash-image-preview
) permite editar
imagens além de gerá-las. Com esse lançamento em prévia pública, o Gemini 2.5 Flash Image oferece edição aprimorada de imagens e edição em várias etapas, além de filtros de segurança atualizados que proporcionam uma experiência do usuário mais flexível e menos restritiva.
Ele é compatível com as seguintes modalidades e recursos:
Edição de imagens (texto e imagem para imagem)
- Comando de exemplo: "Edite esta imagem para que ela pareça um desenho animado"
- Exemplo de comando: [imagem de um gato] + [imagem de um travesseiro] + "Crie um ponto cruz do meu gato neste travesseiro."
Edição de imagens com várias interações (chat)
- Exemplos de comandos: [faça upload de uma imagem de um carro azul.] "Transforme este carro em um conversível." "Agora mude a cor para amarelo." "Adicionar um spoiler".
Editar uma imagem
Console
Para editar imagens:
- Abra Vertex AI Studio > Criar comando.
-
Clique em Trocar modelo e selecione
gemini-2.5-flash-image-preview
no menu. - No painel Saídas, selecione Imagem e texto no menu suspenso.
- Clique em Inserir mídia ( ) e selecione uma origem no menu. Depois, siga as instruções da caixa de diálogo.
- Escreva as edições que você quer fazer na imagem na área de texto Escreva um comando.
- Clique no botão Comando ( ).
O Gemini vai gerar uma versão editada da imagem fornecida com base na sua descrição. Esse processo leva alguns segundos, mas pode ser mais lento dependendo da capacidade.
Python
Instalar
pip install --upgrade google-genai
Para saber mais, consulte a documentação de referência do SDK.
Defina variáveis de ambiente para usar o SDK de IA generativa com a Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_VERTEXAI=True
REST
Execute o comando a seguir no terminal para criar ou substituir esse arquivo no diretório atual:
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
https://${API_ENDPOINT}:generateContent \
-d '{
"contents": {
"role": "USER",
"parts": [
{"file_data": {
"mime_type": "image/jpg",
"file_uri": "<var>FILE_NAME</var>"
}
},
{"text": "Convert this photo to black and white, in a cartoonish style."},
]
},
"generation_config": {
"response_modalities": ["TEXT", "IMAGE"],
},
"safetySettings": {
"method": "PROBABILITY",
"category": "HARM_CATEGORY_DANGEROUS_CONTENT",
"threshold": "BLOCK_MEDIUM_AND_ABOVE"
},
}' 2>/dev/null >response.json
O Gemini vai gerar uma imagem com base na sua descrição. Esse processo leva alguns segundos, mas pode ser comparativamente mais lento dependendo da capacidade.
Edição de imagens com várias interações
A prévia de imagens do Gemini 2.5 Flash também oferece suporte a uma edição aprimorada com várias interações, permitindo que você responda ao modelo com mudanças depois de receber uma resposta de imagem editada. Assim, você pode continuar fazendo edições na imagem de forma conversacional.
Recomendamos limitar o tamanho total do arquivo de solicitação a 50 MB.
Para testar a edição de imagens em várias etapas, confira nosso notebook de prévia do Gemini 2.5 Flash Image.