Google coloca à disposição modelos Gemini para criação rápida de conteúdo visual e vídeo
A Google anunciou o lançamento de dois modelos de inteligência artificial generativa com o objetivo de tornar mais simples e célere a produção de conteúdo multimédia. O Nano Banana 2 Lite, integrando tecnologia Gemini, foi desenvolvido com foco em rapidez de processamento e minimização de custos operacionais, superando significativamente o desempenho de iterações anteriores. O modelo demonstra fiabilidade em interpretar instruções textuais, mantém consistência visual de personagens e produz textos dentro das imagens com clareza apropriada.
Paralelamente, o Google DeepMind disponibilizou o Gemini Omni Flash para manipulação de vídeos de qualidade profissional, permitindo tanto a geração quanto a edição. Este modelo processa entradas variadas — descrições textuais, ficheiros de imagem ou sequências de vídeo — facilitando a produção de experiências interativas sofisticadas. O acesso é oferecido com uma estrutura de preços vantajosa: 0,10 dólares por segundo de conteúdo gerado.
A abordagem proposta pela Google possibilita aos criadores utilizar os dois modelos num único processo: produzir uma imagem com o Nano Banana 2 Lite e posteriormente animá-la em vídeo polido através do Gemini Omni Flash. Ambos são acessíveis aos programadores por intermédio de interfaces de programação e estúdios de desenvolvimento, além de integrados nos serviços ao consumidor como Gemini, Search, Photos e Google Ads. Para fins de rastreamento, utilizam a tecnologia SynthID de marca d'água digital que possibilita autenticar conteúdo originário de IA.