Google lança o Nano Banana 2.1 e o EmbeddingGemma 2 no mesmo dia

A Google tratou 6 de outubro de 2026 como um dia de dois lançamentos de inteligência artificial que se complementam. De um lado, o modelo de imagem Nano Banana 2.1 começa a chegar aos produtos da empresa. Do outro, o EmbeddingGemma 2 abre um modelo leve, com licença Apache 2.0, para busca multimodal direto no aparelho.

O que mudou no Nano Banana 2.1

No perfil oficial, a Google descreveu o Nano Banana 2.1 como a versão mais recente de geração e edição de imagens, com avanços em design visual, edição por máscara e consistência de sujeito. A empresa informou que a distribuição começa no mesmo dia no app Gemini, no AI Mode da Busca, no Google AI Studio, no Flow, no Stitch, no Google Ads e na Gemini Enterprise Platform.

O model card publicado pela DeepMind coloca o Nano Banana 2.1 na família Gemini 3 e o descreve como baseado no Gemini 3.6 Flash. A ficha técnica indica entrada de texto e imagem com janela de até 1 milhão de tokens, saída de imagem com até 4 mil tokens e saída de texto com até 64 mil tokens.

Nas avaliações internas de outubro de 2026, a variante com raciocínio marca 1050 pontos de preferência geral em texto para imagem, contra 990 do Nano Banana 2 (Gemini 3.1 Flash Image) e 935 do Nano Banana Pro. Em edição por máscara ou desenho, o mesmo modo chega a 1049, acima dos 965 e 927 das gerações anteriores citadas na tabela. A Google também registra limites: texto pequeno ainda pode sair borrado, a consistência de personagem não é perfeita e há falhas ocasionais de localização espacial.

EmbeddingGemma 2, o outro anúncio

Em post separado, a Google confirmou que o EmbeddingGemma 2 já pode ser baixado no Hugging Face e no Kaggle, com chegada prevista ao Model Garden da Gemini Enterprise Agent Platform. O texto do blog, assinado por Sahil Dua e Henrique Schechter Vera, da DeepMind, define o modelo como o mais capaz da empresa para embeddings multimodais no dispositivo.

O EmbeddingGemma 2 tem 740 milhões de parâmetros, arquitetura ligada à Gemma 4 e mapeia texto, código, imagem, áudio e vídeo em um espaço comum. A Google afirma que o predecessor de texto passou de 20 milhões de downloads. A nova versão amplia a janela de contexto para 8 mil tokens, quatro vezes a do EmbeddingGemma original, o suficiente, segundo a empresa, para até 5,5 minutos de áudio, 29 imagens ou 58 quadros de vídeo.

O desenho é modular: cerca de 270 milhões de parâmetros bastam para texto, com encoders opcionais de visão (170 milhões) e áudio (300 milhões). Com a técnica Matryoshka, os vetores de 768 dimensões podem ser cortados até 128, o que a Google associa a uma redução de até seis vezes no armazenamento. Em um Pixel 11 Pro, a empresa cita cerca de 191 MB de RAM ativa para os pesos só de texto e cerca de 567 MB para o modelo multimodal completo, após quantização.

No benchmark MTEB Code, o salto informado é de 68,76 para 78,68 pontos. Os pesos estão no Hugging Face e no Kaggle, com suporte citado a transformers, sentence-transformers, llama.cpp, Ollama e LM Studio.

Por que os dois anúncios conversam

Não são o mesmo produto. O Nano Banana 2.1 gera e edita imagens dentro dos serviços da Google. O EmbeddingGemma 2 organiza e recupera mídia localmente, sem substituir um gerador de imagem. Juntos, porém, mostram a mesma estratégia do dia: um modelo fechado, distribuído nos apps, e um modelo aberto, pensado para busca e RAG no aparelho.

O que ainda não está detalhado no anúncio público é preço separado do Nano Banana 2.1 e o calendário exato do Model Garden para o EmbeddingGemma 2. A Google diz apenas que a disponibilidade nessa plataforma vem em seguida.

Fontes

Transparência: Este conteúdo foi criado, editado ou revisado com auxílio de inteligência artificial. As informações foram cruzadas com publicações públicas no X e fontes disponíveis na internet. Consulte as fontes originais para verificar o contexto completo.

Por GeekikiBot