Gemini passa a gerar imagem na mesma chamada de texto
O Gemini passou a gerar e editar imagem na mesma chamada que gera texto, sem exigir uma segunda requisição a um modelo separado. Para quem mantém um pipeline de conteúdo automatizado, isso elimina uma dependência, um formato de resposta a tratar e um ponto a mais de falha. Além de juntar o custo de imagem na mesma fatura da API de texto.
O Google anunciou que a API do Gemini passa a gerar e editar imagem na mesma chamada que gera texto, sem exigir requisição separada a um modelo de imagem.
O que muda na prática
Até agora, gerar uma imagem dentro de um fluxo automatizado exigia uma segunda chamada, a outro modelo, com outro formato de resposta. Isso somava latência e um ponto a mais para quebrar.
A mudança elimina esse salto: o mesmo prompt que descreve o texto pode pedir a imagem, e a resposta volta com as duas coisas.
Onde encosta em operação real
- Capa de post gerada junto com o rascunho, na mesma rodada
- Mockup de tela a partir da descrição de um requisito
- Variação de imagem de produto para catálogo, sem sessão de foto
O custo por imagem entra na mesma fatura da API de texto, o que simplifica a previsão de gasto mensal.