Gemini Omni 1.1 Flash amplia controle na geração de vídeo
Modelo do Google DeepMind permite estender cenas, definir quadros-chave e rascunhar em baixa resolução
O que aconteceu
O Google DeepMind anunciou o Gemini Omni 1.1 Flash em 27 de agosto de 2026, uma nova suíte de controles criativos e capacidades de vídeo generativo para desenvolvedores. O Gemini Omni 1.1 Flash, modelo do Google DeepMind, foi apresentado como uma evolução do Gemini Omni, que já trazia raciocínio de mundo real para a criação generativa. Segundo a empresa, as atualizações tornam o Omni 1.1 pronto para produção profissional, permitindo fluxos de trabalho de vídeo generativo, ferramentas criativas e softwares de edição de mídia com mais controle, iteração mais rápida e acabamento para implantação em escala real.
Entre os novos recursos, destaca-se a extensão de cenas. O Gemini Omni 1.1 Flash pode analisar até 10 segundos de contexto anterior, um salto em relação aos modelos anteriores, que consultavam apenas o último segundo. O modelo permite estender vídeos em incrementos de 10 segundos, até um total acumulado de 40 segundos. Essa capacidade garante consistência visual e aderência narrativa, facilitando a construção de histórias mais longas ou a exploração de novos rumos criativos.
Outro recurso é a especificação de primeiro e último frames. O Gemini Omni 1.1 Flash permite definir os quadros inicial e final de uma cena, gerando vídeo contínuo entre dois keyframes. Isso é ideal para movimentos de câmera complexos, como órbitas, transições de zoom ou loops contínuos. A empresa ilustrou com prompts que descrevem transições fluidas entre um baterista e um saxofonista, ou um zoom em uma tela de TV com a mesma personagem, sempre em um único take, sem cortes.
Contexto
O Gemini Omni original já oferecia raciocínio de mundo real aplicado à geração criativa, mas as limitações de contexto e o custo de processamento reduziam sua aplicação prática. O Gemini Omni 1.1 Flash chega para resolver esses gargalos, combinando o modelo de baixa latência com controles criativos mais precisos. A extensão do contexto de 1 segundo para 10 segundos é uma mudança estrutural, pois permite que o modelo mantenha coerência em sequências mais longas, algo raro em ferramentas de vídeo generativo até então.
A opção de rascunho em 360p também responde a uma demanda antiga dos desenvolvedores: prototipar e iterar sem desperdício de recursos. O Gemini Omni 1.1 Flash gera rascunhos em 360p até 60% mais rápido e a um terço do custo em comparação à resolução padrão de 720p do próprio modelo. Essa diferença torna o processo de criação mais acessível para estúdios pequenos, agências ou desenvolvedores independentes que dependem de múltiplas tentativas para refinar uma cena.
Por que importa
Para quem desenvolve ferramentas de edição, plataformas de storytelling ou workflows de vídeo, o Gemini Omni 1.1 Flash oferece controle fino sobre o resultado final. Especificar primeiro e último frames, por exemplo, elimina a necessidade de pós-edição para alinhar transições de câmera, reduzindo o tempo de produção. O custo reduzido dos rascunhos em 360p permite testar ideias rapidamente antes de investir na renderização completa em alta resolução.
Em termos práticos, um estúdio que produz animações curtas pode usar a extensão de cena para criar sequências de até 40 segundos com consistência visual, algo que antes exigiria múltiplos modelos ou correções manuais. A leitura de 10 segundos de contexto garante que personagens, cenários e iluminação permaneçam coerentes ao longo da extensão, o que reduz o retrabalho.
Impacto
No curto prazo, o Gemini Omni 1.1 Flash deve acelerar o desenvolvimento de protótipos em vídeo generativo, especialmente em áreas como publicidade, entretenimento e educação. A redução de custo e o aumento de velocidade no rascunho permitem que equipes pequenas concorram com grandes estúdios, pois a barreira financeira para experimentação cai drasticamente. O modelo também amplia as possibilidades de integração com ferramentas de edição, já que a API pode ser chamada programaticamente, como demonstra o código de exemplo fornecido pelo Google DeepMind.
No médio prazo, a capacidade de especificar quadros-chave pode se tornar um padrão para ferramentas de cinema gerativo, permitindo que diretores controlem a composição de cada plano sem depender de sorte de geração. A extensão de cena com contexto de 10 segundos, por sua vez, abre caminho para narrativas longas e episódicas, um mercado que ainda carece de soluções consistentes.
O que vem agora
O Gemini Omni 1.1 Flash já está disponível para desenvolvedores via Gemini API no Google AI Studio. O Google DeepMind não divulgou planos de expansão para outras resoluções ou recursos adicionais, mas a arquitetura do modelo sugere que novos controles podem surgir em versões futuras. A empresa espera que a combinação de velocidade, custo e precisão atraia uma comunidade mais ampla de desenvolvedores ao ecossistema Gemini, ampliando casos de uso em vídeo generativo e além.
Fontes
- Google DeepMind (oficial): Gemini Omni 1.1 Flash lets you build with more control
