Nano banana

Nano Banana: o guia completo para criar imagens profissionais com inteligência artificial

Do primeiro prompt a fluxos avançados: aprenda a usar o Nano Banana do zero

A maior parte das pessoas que abre um gerador de imagens com inteligência artificial faz a mesma coisa: digita duas ou três palavras no campo de texto, aperta o botão e espera que a mágica aconteça. Às vezes funciona. Na maioria das vezes, o resultado é genérico, inconsistente ou simplesmente frustrante.

O Nano Banana, modelo de geração de imagens do Google, não é diferente de qualquer outra ferramenta nesse sentido: o que você coloca é o que você recebe. A diferença é que, quando você entende como estruturar suas instruções, ele entrega resultados que rivalizam com fotografia profissional, arte gráfica e design de produto.

Ao final deste artigo, você vai saber como acessar a ferramenta, como formular prompts que funcionam, como manter consistência entre imagens e como aplicar tudo isso em casos de uso reais, independentemente do seu nível de experiência com IA.

1. O que é o Nano Banana e onde acessá-lo

O Nano Banana é um modelo de geração e edição de imagens desenvolvido pelo Google. Ele funciona com base em inteligência artificial generativa, ou seja, a partir de uma descrição em texto, ele é capaz de criar ou modificar imagens com alto grau de realismo e controle.

Existem três versões principais do modelo:

• Nano Banana (versão padrão): modelo base, disponível gratuitamente no Google Gemini e no Google AI Studio.

• Nano Banana 2 (NB2): versão aprimorada com maior capacidade de raciocínio visual, suporte a até 14 imagens de referência simultâneas e acesso à web em tempo real durante a geração.

• Nano Banana Pro: versão premium com saída em resolução 4K, controles tipográficos avançados e maior fidelidade a detalhes de marca.

Para seguir este guia, você não precisa pagar nada. A versão gratuita do modelo no Google AI Studio ou no Gemini já permite realizar a maior parte dos exercícios aqui descritos. Usuários gratuitos têm direito a até 20 gerações por dia com exportação em resolução 1K. Assinantes do Gemini Advanced têm acesso a 2K. A resolução 4K completa está disponível apenas via AP

Como acessar gratuitamente

Acesse aistudio.google.com ou gemini.google.com, faça login com sua conta Google e selecione o modelo Nano Banana no menu de ferramentas. Não é necessário cadastro em plataformas de terceiros para começar.

O modelo também está integrado a diversas plataformas externas como Adobe Firefly, Freepik, Higgsfield e Crea. Cada uma oferece funcionalidades ligeiramente diferentes, mas a lógica de uso, especialmente a estrutura de prompts, é a mesma em todas elas.

2. Entendendo a interface antes de começar

Antes de escrever qualquer prompt, vale conhecer os elementos da interface do Google AI Studio. Essa etapa poupa muito tempo de tentativa e erro.

O campo de prompt é onde você descreve o que quer criar ou modificar. É a sua principal forma de comunicação com o modelo. Logo abaixo ou ao lado, dependendo do layout, há a seção de imagens de referência, onde você pode carregar até oito fotos que servem como guia visual para a geração.

Os controles de resolução permitem escolher entre 1K, 2K e 4K. Para a maioria dos usos cotidianos, 2K oferece a melhor relação entre qualidade e velocidade de geração. A proporção da imagem pode ser ajustada entre quadrada (ideal para posts em redes sociais), vertical (para stories e anúncios) e horizontal (para banners e capas de YouTube).

Há também um botão chamado Enhance Prompt, que expande automaticamente o prompt que você digitou, adicionando detalhes e estrutura para melhorar o resultado. É útil quando você está começando ou quer uma segunda opinião sobre como melhorar sua descrição. Para aprender a estruturar prompts de verdade, porém, é importante entender o processo antes de delegar essa tarefa a um botão.

3. A fórmula dos seis componentes: como estruturar prompts que funcionam

A diferença entre um prompt que gera uma imagem genérica e um que gera algo utilizável está, quase sempre, no nível de especificidade. O modelo não lê intenções: ele responde ao que você escreveu, palavra por palavra.

A estrutura mais eficaz para criar imagens consistentes e profissionais segue seis componentes. Você pode pensar neles como as perguntas que um fotógrafo responderia antes de apertar o obturador: quem está na imagem, o que está fazendo, onde, com qual estética, sob qual iluminação e com quais detalhes finais.

Componente 1: Sujeito

Descreva com precisão o que ou quem aparece na imagem. Evite generalizações. Em vez de escrever "uma mulher", escreva algo como "uma mulher no início dos trinta anos, cabelo castanho médio preso em um rabo de cavalo, usando uma blusa amarela de poá e calça jeans de cintura alta". Quanto mais específico, menos o modelo precisa adivinhar, e menos ele vai variar entre gerações.

Componente 2: Ação

O que o sujeito está fazendo? Ficar de pé é diferente de caminhar, que é diferente de olhar para a câmera com um sorriso relaxado. A ação transforma uma figura estática em uma cena com intenção. Inclua expressão, postura e direção do olhar quando relevante.

Componente 3: Ambiente

Onde a cena acontece? Descreva o contexto com o mesmo cuidado que você dedicou ao sujeito. "Em um bairro residencial iluminado pelo sol, casa moderna de reboco branco com jardim cuidado ao fundo, palmeiras visíveis nas laterais" é muito mais eficaz do que "em frente a uma casa".

Componente 4: Estilo artístico

Qual é a estética desejada? Você pode referenciar estilos fotográficos ("fotografia editorial no estilo da Vogue"), movimentos artísticos ("impressionismo"), diretores de fotografia, ou até publicações e marcas cujo visual você admira. O modelo foi treinado em milhões de imagens rotuladas e reconhece essas referências com precisão.

Componente 5: Iluminação

A iluminação é o elemento que mais frequentemente separa um resultado amador de um profissional. Especifique a qualidade da luz (suave, dura), a direção (lateral esquerda, de cima, contra-luz), a temperatura (quente como a luz do fim de tarde, fria como a luz natural de janela) e o efeito desejado (sombras dramáticas, iluminação de aro). Termos fotográficos reais como "iluminação Rembrandt" ou "iluminação borboleta" funcionam muito bem porque o modelo foi treinado a partir de fotografias rotuladas com esses termos.

Componente 6: Detalhes finais

Inclua especificações técnicas e acabamentos: a lente utilizada ("lente 85mm, foco raso"), textura da imagem ("grão de filme sutil"), logotipos ou marcas d'água a incluir, e qualquer elemento que não se encaixe nas categorias anteriores. Esses detalhes são o que diferencia uma imagem funcional de uma imagem pronta para uso profissional.

Por que isso funciona

O Nano Banana 2 foi construído sobre a mesma arquitetura de raciocínio do Gemini, o assistente de IA do Google. Isso significa que ele não apenas associa palavras a pixels: ele entende relações entre elementos, contexto e intenção. Ao estruturar o prompt em componentes claros, você está falando a língua nativa do modelo.

Veja a fórmula em ação: do simples ao avançado

Abaixo estão três exemplos reais usando os seis componentes, em níveis crescentes de complexidade.

Exemplo simples:

Exemplo de prompt

Uma xícara de café branca sobre uma mesa de madeira rústica. Luz suave da manhã vinda de uma janela. Estilo minimalista. Fundo branco limpo. Vista de cima. Sombras naturais.

Exemplo intermediário:

Exemplo de prompt

Um empreendedor de tecnologia na faixa dos 35 anos, moletom cinza casual e óculos de aro preto, sentado em uma mesa branca moderna com MacBook Pro e caderno de couro, digitando com expressão concentrada. Ambiente: espaço de coworking amplo com janelas do chão ao teto e plantas em prateleiras. Luz natural entrando pela direita. Estilo fotorrealista com leve grão de filme, capturado com lente 35mm. Gradação de cor quente.

Exemplo avançado:

Exemplo de prompt

Uma cena de rua cyberpunk à noite no Neon Tokyo. Letreiros luminosos em azul e rosa com kanji japonês refletidos na calçada molhada. Uma figura solitária com sobretudo preto e óculos reflexivos caminha na névoa, mãos nos bolsos. Arranha-céus ao fundo encobertos por neblina e feixes de luz. Estilo cinematográfico sci-fi inspirado em Blade Runner e Ghost in the Shell. Iluminação de alto contraste com rims de luz separando a figura do fundo escuro. Capturado com lente grande angular 24mm, ângulo baixo criando escala épica. Flare sutil das luzes neon, texturas ultra-detalhadas em roupa e chão molhado, névoa em camadas para profundidade atmosférica.

Note que os três exemplos seguem exatamente a mesma estrutura. O que muda é o nível de detalhe em cada componente. Comece pelo simples, teste, observe o resultado e vá acrescentando especificidade.

4. Como manter consistência entre imagens

Um dos maiores desafios ao criar conteúdo com geradores de imagem é a inconsistência. Você cria uma personagem incrível em uma imagem e, quando tenta reproduzi-la em outro cenário, o rosto muda, o cabelo fica diferente, a pessoa parece outra. Isso acontece porque, por padrão, o modelo trata cada geração como um evento independente.

O Nano Banana oferece duas ferramentas principais para resolver esse problema: o Character Builder e o sistema de imagens de referência

Character Builder: criando personagens reutilizáveis

O Character Builder, disponível dentro do AI Studio na seção de personagens, permite que você crie uma persona completa com escolhas de estilo, idade, gênero, tipo de cabelo e traços faciais. Ao gerar, o sistema cria automaticamente múltiplos ângulos e expressões do mesmo personagem de uma só vez: visão frontal, de perfil, em três quartos, sorrindo, neutro, surpreso.

Esse personagem fica salvo na sua biblioteca. Em qualquer geração futura, você pode selecioná-lo no menu suspenso ou referenciá-lo diretamente no prompt usando o símbolo @. A partir daí, a identidade visual fica bloqueada: você muda o cenário, a roupa, a iluminação, mas o rosto permanece o mesmo.

Como usar na prática

Crie o personagem uma vez no Character Builder. Em seguida, use prompts como: [Selecione o personagem da biblioteca] em uma cafeteria moderna, luz natural de janela. Gere. Depois: [Mesmo personagem] sentado em um carro de luxo, iluminação ao entardecer. O rosto não muda entre as gerações.

O sistema de até oito imagens de referência

Quando você tem fotos de um produto real, um logotipo, uma paleta de cores ou um estilo visual que precisa replicar, o Nano Banana 2 permite carregar até oito imagens de referência ao mesmo tempo. O modelo analisa todas elas e usa esse contexto visual para gerar assets que parecem pertencer à mesma identidade visual.

Na prática, isso funciona assim: suponha que você está criando materiais para uma marca de cosméticos. Você carrega o logotipo da marca, duas fotos do produto em ângulos diferentes, uma cartela de cores e uma imagem de mood board com a estética desejada. São cinco referências. Agora seu prompt pode simplesmente dizer "produto da referência sobre uma bancada de mármore branco, luz natural suave da esquerda, estilo de fotografia de produto minimalista" e o modelo vai gerar algo fiel à identidade visual sem que você precise descrever cada detalhe do produto em texto.

Dica importante

Pesquisas práticas indicam que usar mais de seis imagens de referência simultaneamente pode, na verdade, degradar a qualidade estrutural do resultado. O modelo começa a receber sinais conflitantes. Seis referências bem escolhidas superam 14 referências mediocres.

5. Casos de uso práticos: o que você pode fazer com o Nano Banana

A seguir, você encontra os principais casos de uso documentados por criadores e profissionais, cada um com a lógica por trás e exemplos de prompts que você pode adaptar.

Retratos e headshots profissionais

Fotografias de perfil profissional são um dos usos mais populares do modelo. O processo é direto: para obter um headshot convincente, especifique explicitamente o tipo de imagem ("headshot profissional"), o fundo desejado ("fundo neutro cinza" ou "fundo desfocado") e o estilo de iluminação de estúdio.

Exemplo de prompt

Headshot profissional de um homem de 30 anos, cabelo preto curto, sem barba, terno azul marinho, fundo neutro cinza. Iluminação de estúdio. Foco nítido no rosto, fundo levemente desfocado. Estilo de fotografia corporativa.

Para variar expressões mantendo a mesma pessoa, basta alterar uma palavra no prompt: "sorrindo levemente" no lugar de "expressão confiante". Para explorar diferentes etnias, gêneros ou faixas etárias, basta substituir a descrição do sujeito. A qualidade técnica se mantém.

Fotografia de produto para e-commerce

Lojistas e vendedores de plataformas como Amazon frequentemente precisam de múltiplas fotos de produto em contextos diferentes, sem orçamento para um estúdio fotográfico. O Nano Banana resolve isso com física simulada, ou seja, ele entende como objetos interagem com o ambiente: reflexos, respingos d'água, superfícies, sombras.

Exemplo de prompt

Tênis branco esportivo moderno sobre superfície de madeira, luz solar natural, fundo minimalista. Fotografia de produto. [Variação: mesmo tênis em movimento no ar, congelado, fundo de rua urbana, composição dinâmica. Variação: mesmo tênis explodindo em respingo d'água, frame congelado, fundo preto, estética de fotografia de alta velocidade.]

Para manter consistência entre todas as fotos de um mesmo produto, use o Product Builder, que funciona com a mesma lógica do Character Builder: você carrega fotos do produto real, e o sistema cria uma referência reutilizável para todas as gerações seguintes.

Edição de imagens existentes

Além de criar imagens do zero, o Nano Banana é especialmente poderoso na edição de fotos reais. Você carrega uma imagem e descreve o que quer modificar. A lista do que é possível é extensa.

• Remover pessoas, objetos ou elementos indesejados de uma foto sem deixar rastros visíveis.

• Trocar o fundo de uma imagem mantendo a iluminação e as sombras do sujeito coerentes com o novo cenário.

• Substituir roupas em fotos de pessoas, respeitando a física do tecido e o ajuste no corpo.

• Mudar a cor de objetos específicos sem alterar o resto da imagem.

• Colorizar fotos em preto e branco com precisão histórica.

• Envelhecer ou rejuvenescer rostos em fotografias com resultados realistas.

• Transportar uma pessoa para outra época, adaptando roupas, iluminação e estética ao período.

Para edições precisas, uma técnica útil é a anotação direta sobre a imagem. Abra a foto em qualquer programa de edição básico, como o Paint do Windows, desenhe setas ou escreva notas indicando exatamente onde quer que a mudança aconteça, salve a versão anotada e use-a como referência. O prompt então pode ser simplesmente "siga todas as anotações e instruções da imagem e remova as marcações ao final".

Arte, estilização e transferência de estilo

O modelo consegue aplicar estilos artísticos específicos a qualquer imagem. Você pode pedir uma versão em estilo Studio Ghibli, manga shonen, hiper-realismo, impressionismo ou qualquer outro referencial visual. Para resultados mais precisos, carregue uma imagem do estilo desejado como referência além de descrever o estilo no prompt.

Exemplo de prompt

Transforme esta foto da rua em aquarela no estilo impressionista de Monet. Preserve a composição original, mas renderize com pinceladas visíveis, paleta de cores suaves e textura de tela.

Uma variação interessante é a estilização parcial: você pode pedir que apenas um elemento da imagem mude de estilo, mantendo o resto fotorrealista. Por exemplo, transformar apenas um prato de comida em ilustração animada enquanto o resto da cena permanece como foto.

Anúncios para redes sociais

Marcas precisam de múltiplas variações de peças publicitárias para testes A/B, em diferentes formatos, cores e abordagens visuais. Com o Nano Banana, é possível gerar uma imagem hero de um produto e depois criar variações sistemáticas alterando apenas um elemento por vez: cor de fundo, ângulo, iluminação, contexto.

Para stories e anúncios verticais, especifique a composição vertical no prompt e deixe espaço para texto nos extremos superior e inferior. Para carrosséis, gere três a cinco variações da mesma cena com alterações controladas para que o conjunto tenha coesão visual.

O modelo também renderiza texto diretamente na imagem com o que é chamado de motor de renderização tipográfica. Você pode solicitar que um título ou chamada apareça integrado à imagem com fonte e estilo especificados.

Capas de livros e materiais editoriais

Para autores que publicam de forma independente em plataformas como o Amazon KDP, a capa do livro é um dos principais fatores de conversão. O modelo consegue criar composições completas com título, nome do autor e elementos visuais integrados, desde que o prompt especifique com clareza a tipografia desejada.

Exemplo de prompt

Design de capa de livro. Título em destaque: 'A Última Testemunha', fonte serifada em negrito. Nome do autor na parte inferior. Fundo: beco escuro à noite, poste solitário, figura misteriosa na sombra. Iluminação cinematográfica noir, alto contraste. Tipografia legível e profissional.

Visualização arquitetônica e design de interiores

Arquitetos, designers de interiores e proprietários de imóveis podem usar o modelo para visualizar transformações em espaços reais. Basta carregar uma foto do ambiente e descrever as mudanças desejadas. O modelo consegue aplicar novos revestimentos, trocar móveis, adicionar paisagismo, mudar a iluminação do ambiente, sugerir papéis de parede em paredes específicas e até mostrar como um espaço externo ficaria com diferentes projetos paisagísticos.

Para visualização arquitetônica mais técnica, o modelo consegue criar cortes transversais didáticos de edificações a partir de fotos externas, mostrando a distribuição interna dos cômodos. É um recurso útil para apresentações e materiais educativos, não para substituir softwares de projeto como CAD.

Infográficos e materiais educativos

O modelo consegue criar infográficos completos com diagramas, setas, texto anotado e hierarquia visual. É útil para educadores, criadores de conteúdo e profissionais de marketing que precisam explicar processos ou dados de forma visual.

Exemplo de prompt

Crie um infográfico profissional explicando como funciona a fotossíntese. Inclua diagramas rotulados, setas mostrando o fluxo de energia, seções coloridas para cada etapa do processo e texto explicativo legível integrado ao design.

Storyboards e quadrinhos

Para criadores de conteúdo audiovisual, roteiristas e artistas, o modelo consegue gerar páginas completas de quadrinhos com painéis múltiplos, balões de fala legíveis e progressão narrativa coerente. Ao carregar a página gerada como referência e pedir a continuação da história, o modelo analisa o que já aconteceu e gera os próximos painéis mantendo o estilo e a continuidade narrativa.

6. Técnicas avançadas que poucos conhecem

Uma vez que você domina a fórmula básica, há um conjunto de técnicas que expandem significativamente o controle sobre os resultados. Nenhuma delas exige conhecimento técnico avançado.

Usando JSON para controle preciso sobre edições

JSON é uma sigla em inglês para JavaScript Object Notation. É uma forma de organizar informações em campos nomeados, como uma lista com etiquetas. Você não precisa saber programar para usar essa técnica: o raciocínio é o mesmo de preencher um formulário bem estruturado.

A vantagem do JSON no contexto do Nano Banana é simples: quando você descreve uma cena em texto corrido, o modelo precisa interpretar todo o conjunto de uma vez. Quando você usa um formato estruturado, cada elemento da imagem tem seu próprio campo. Mudar a cor da poltrona significa alterar apenas o campo "cor da poltrona", sem afetar o tapete, a luminária ou a perspectiva da câmera.

Para extrair o JSON de uma imagem que você gostou, cole a imagem no Google Gemini e use o prompt "Extraia todas as informações desta imagem e converta em JSON estruturado". O modelo vai devolver uma descrição detalhada de cada objeto com suas propriedades: material, cor, posição, proporções. Salve esse JSON, faça os ajustes que quiser em campos específicos e use-o como prompt no AI Studio com a instrução "Modifique esta imagem com base no JSON a seguir".

Exemplo prático de JSON

Imagine que você gerou uma sala de estar perfeita, mas o cliente quer trocar a poltrona bege por uma de veludo bordô. Em vez de regenerar tudo, você edita apenas o campo: 'armchair: { color: "deep burgundy", material: "velvet" }'. O tapete, a luminária, as proporções e a perspectiva permanecem exatamente iguais.

Web search integrado: gerando imagens com referências atuais

Dentro da interface do Nano Banana 2, há uma caixa de seleção chamada Web Search que pode ser ativada durante a geração. Quando habilitada, o modelo não se limita aos dados com os quais foi treinado: ele busca referências visuais atuais na internet durante o processo de geração.

Isso faz diferença para qualquer coisa com apelo temporal. Ao pedir "SUV elétrico moderno, design 2026", o modelo com web search ativado consulta referências reais dos designs mais recentes, não o que ele aprendeu durante o treinamento. Para tendências visuais de moda, design de produto ou arquitetura, essa função pode elevar significativamente a relevância do resultado.

Usar a colagem como workaround para o limite de uploads

O Nano Banana tem um limite de imagens que podem ser carregadas por prompt. Uma forma de contornar esse limite é reunir todas as imagens de referência em uma única imagem usando qualquer editor básico como o Canva ou mesmo o PowerPoint, salvar como JPG e carregar essa colagem. O modelo consegue interpretar os elementos individuais dentro da colagem e usá-los como referências separadas.

Redo with Pro: iterar rápido, finalizar com qualidade

Para assinantes do Gemini Advanced, há um fluxo de trabalho que combina velocidade com qualidade: use o Nano Banana 2 para iterar rapidamente nas composições, testando variações sem custo de tempo ou crédito. Quando chegar em um resultado que agrada, clique no menu de três pontos sobre a imagem gerada e selecione "Redo with Nano Banana Pro". Com um clique, a mesma composição é rerenderizada na máxima fidelidade. Itere no 2, finalize no Pro.

7. Do estático ao dinâmico: transformando imagens em vídeo

Uma das extensões mais poderosas do fluxo de trabalho com Nano Banana é a integração com ferramentas de geração de vídeo. Depois de criar uma imagem com alta qualidade e composição controlada, você pode importá-la diretamente em plataformas como Kling, Sora, Veo ou RunwayML e transformá-la em um clipe animado.

A lógica é direta: o Nano Banana resolve o problema da composição estática com precisão. As ferramentas de vídeo resolvem o problema do movimento. Combinados, eles permitem criar campanhas visuais completas sem precisar de câmera, estúdio ou atores.

Para personagens criados com o Character Builder, a consistência visual se mantém ao longo de todos os frames do vídeo: é o mesmo rosto, a mesma identidade, em movimento. Para produtos, a animação pode incluir efeitos como o líquido dentro de uma embalagem transparente se movendo enquanto o frasco é segurado, ou a água respingando ao redor de um tênis em câmera lenta.

O processo prático é simples: gere a imagem no Nano Banana com a composição e iluminação desejadas, salve o arquivo, importe em uma das plataformas de vídeo e descreva o movimento que você quer ver. A imagem funciona como frame inicial, e o modelo de vídeo interpola os frames seguintes a partir dela.

Conclusão

Dominar o Nano Banana não é uma questão de descobrir a combinação certa de palavras mágicas. É uma questão de entender como comunicar intenção de forma estruturada para um sistema que, diferente de geradores mais antigos, é capaz de raciocinar sobre relações entre elementos visuais.

A fórmula dos seis componentes é o ponto de entrada. O sistema de referências é o que garante consistência. As técnicas avançadas, como JSON e web search, são o que separa resultados funcionais de resultados profissionais.

Mas há uma limitação que nenhum guia pode resolver por você: o Nano Banana responde ao que você pede, e você só aprende a pedir melhor testando. Pegue três casos de uso deste artigo que se encaixam em algo que você já faz ou quer fazer, abra o AI Studio agora e execute. O modelo não vai te julgar pelas primeiras tentativas. E a distância entre uma imagem genérica e uma imagem utilizável, você vai perceber, é menor do que parece.

Keyword principal: nano banana guia completo

Meta description: Aprenda a usar o Nano Banana do zero: fórmula de prompts, consistência de personagens, edição de imagens e casos de uso práticos em um guia completo.

Guia

Descubra nosso guia de IA para estudantes.

Contato

Suporte

contato@tekmentor.com.br

© 2025. All rights reserved.

CNPJ 62.368.454/0001-77