Geração de imagem
Disponível agora

Gemini Image

por Google

O modelo de imagem multimodal do Google.
Imagens sensíveis ao contexto, edição por conversa e texto preciso dentro da imagem, tudo em um único fluxo.

Gemini Image

por Google

Principais recursos

Especificações técnicas

HD

Saída de imagem em alta definição

Superior

Texto em imagens líder do setor

Yes

Edição de imagem por conversa

Text + Image

Entradas multimodais de texto e imagem

Casos de uso

Materiais de marketing com texto

Gere artes para redes sociais, banners e imagens promocionais com texto legível embutido. Sem precisar do Photoshop para trabalhos tipográficos básicos.

Visualização de produto

Crie imagens realistas de produto com rótulos precisos, texto de embalagem e elementos de marca legíveis e corretamente renderizados.

Diagramas educacionais

Gere diagramas rotulados, infográficos e materiais educacionais com anotações de texto bem renderizadas e conteúdo factual preciso.

Trabalho criativo iterativo

Refine imagens passo a passo por conversa. Ajuste cores, modifique elementos, adicione detalhes, tudo com instruções em linguagem simples.

Conteúdo cultural e histórico

Gere imagens historicamente e culturalmente precisas. A base de conhecimento do Google mantém detalhes de época, arquitetura e contexto fiéis à realidade.

Geração de cenas realistas

Gere cenas do mundo real em estilo fotorrealista, paisagens urbanas, natureza, interiores, com detalhes precisos e iluminação natural em cada quadro.

Exemplos de prompts

Design com muito texto

A modern coffee shop menu board with chalk-style lettering, items listed clearly: Espresso $4, Latte $5, Cappuccino $5, warm lighting, rustic wooden frame

Edit prompt

Produto com marca

A premium skincare bottle with the label reading 'LUMINA GLOW' in elegant serif font, glass bottle on a marble surface, soft studio lighting

Edit prompt

Educacional

A labeled cross-section diagram of the human heart, medical illustration style, clear anatomical labels pointing to each chamber and valve

Edit prompt

Preços simples

Comece grátis hoje mesmo, com a opção de fazer upgrade ou cancelar quando quiser.

Basic

$9/ mês
cobrado como $0 por ano

900 mensal créditos

1 apenas usuário

Todos os modelos

Workflows

Standard

$24/ mês
cobrado como $0 por ano

3200 mensal créditos

1 apenas usuário

Todos os modelos

Workflows

Pro

$45/ mês
cobrado como $0 por ano

6200 compartilhado mensal créditos

1 usuário

+ até 4 mais com custo adicional

Todos os modelos

Workflows

Pro Max

$170/ mês
cobrado como $0 por ano

24000 compartilhado mensal créditos

1 usuário

+ até 9 mais com custo adicional

Todos os modelos

Workflows

Enterprise

Para limites maiores

Personalizado

termos de preços e cobrança

Créditos de alto volume
Limites de vagas personalizados
Todos os modelos
Workflows
Pricing Gradient

Free

Para experimentar

$0

grátis para sempre

Até 20 créditos
apenas 1 usuário
Modelos limitados
Workflows

Perguntas frequentes

O que é o Gemini Image?
O Gemini Image é o recurso nativo de geração de imagem do modelo multimodal Gemini, do Google. Ele combina compreensão avançada de linguagem com geração visual, produzindo imagens contextualmente precisas com renderização de texto superior.
Por que o Gemini é melhor com texto nas imagens?
Porque o Gemini entende linguagem em um nível profundo (é um modelo multimodal, não apenas de imagem), ele renderiza texto dentro das imagens com mais precisão, ortografia correta, formatação adequada e tipografia legível.
Dá para editar imagens com o Gemini?
Sim. O Gemini suporta edição de imagem por conversa, envie uma imagem, descreva as mudanças que quer em linguagem natural e itere em um diálogo de ida e volta.
Como o Gemini Image se compara ao Flux ou ao GPT Image?
O Gemini se destaca em precisão contextual e renderização de texto graças à sua arquitetura multimodal. O Flux oferece mais versatilidade de estilo e geração mais rápida. O GPT Image tem forte capacidade criativa. Cada um tem pontos fortes próprios.
Como gerar uma imagem com o Gemini Image no Morphic?
Abra o Copilot, descreva o que você quer e selecione o Gemini Image como modelo. A arquitetura multimodal do Gemini o torna especialmente forte em prompts com texto, elementos de marca, placas e referências contextuais.
O Gemini Image consegue seguir prompts longos e descritivos?
Sim. Como o Gemini é um modelo nativo em linguagem, ele lê prompts longos e detalhados com mais consistência do que modelos de imagem puros, útil quando um plano precisa de objetos, layouts ou posicionamento de texto específicos.