O Google DeepMind disponibilizou nesta segunda-feira dois novos modelos de mídia generativa para desenvolvedores: o Nano Banana 2 Lite, voltado para geração de imagens com alta velocidade e baixo custo, e o Gemini Omni Flash, focado em geração e edição conversacional de vídeos com qualidade.
Ambos os modelos estão disponíveis no Google AI Studio, na Gemini API e na Gemini Enterprise Agent Platform. O Nano Banana 2 Lite também chega a produtos de consumo como AI Mode no Search, Gemini app, NotebookLM, Google Photos, Stitch e Google Flow. O Omni Flash está disponível no Gemini app e no Google Flow.
Nano Banana 2 Lite: velocidade e custo como prioridades
O Nano Banana 2 Lite (gemini-3.1-flash-lite-image) é o modelo de imagem mais rápido e econômico da família Nano Banana. Projetado para ideação rápida e pipelines de desenvolvimento de alta velocidade, entrega saídas text-to-image em 4 segundos, com custo de US$ 0,034 por mil imagens.
O modelo é o substituto recomendado para o Nano Banana original (gemini-2.5-flash-image). Apesar de priorizar velocidade, mantém aderência confiável a prompts, consistência forte de personagens e renderização legível de texto em imagens — capacidades que muitos modelos rápidos sacrificam.
Gemini Omni Flash: raciocínio multimodal encontra vídeo
O Gemini Omni Flash (gemini-omni-flash-preview) foi apresentado no Google I/O e agora chega aos desenvolvedores. O modelo combina o raciocínio multimodal do Gemini com geração e edição de vídeo, permitindo experiências de edição conversacional — o usuário interage com o modelo em linguagem natural para modificar vídeos.
O Omni Flash gera vídeos de alta qualidade (1080p) com edição conversacional e suporta múltiplos turnos de interação. O Google destaca sua utilidade em prototipagem visual rápida, criação de assets para marketing e produção de vídeos interativos. O modelo inclui watermarking SynthID em todo conteúdo gerado.
O poder está na combinação
O verdadeiro diferencial está em encadear os dois modelos: usar o Nano Banana 2 Lite para gerar imagens em alta velocidade e então passar essa imagem como referência para o Gemini Omni Flash animá-la em vídeo. O Google demonstrou apps como “Anywhere” (transporte instantâneo para pontos turísticos), “Space Lift” (redesign de interiores) e “Omni Product Studio” (conversão de imagens estáticas em vídeos cinematográficos de e-commerce).
Fonte: Google DeepMind Blog
Descubra mais sobre noticiAI
Assine para receber nossas notícias mais recentes por e-mail.



