News · Google adiciona geração de voz aos Frames to Video do Flow e alarga o Flow a mais de 140 países

Produtos de AI

Google adiciona geração de voz aos Frames to Video do Flow e alarga o Flow a mais de 140 países

O Veo 3 no Flow já consegue gerar diálogo falado a partir de frames iniciais fornecidos pelo utilizador, e a disponibilidade da ferramenta salta para mais de 140 países.

O que realmente foi lançado esta semana

A Google introduziu duas alterações concretas no Flow, a sua ferramenta de criação de vídeo lançada em maio. Primeiro, o fluxo de trabalho Frames to Video — onde o utilizador fornece a sua própria imagem como frame inicial de um clip — já consegue gerar voz falada através do Veo 3, e não apenas os efeitos sonoros e ruído de fundo que já suportava. Segundo, o Frames to Video está agora disponível no Veo 3 Fast, que a Google apresenta explicitamente em termos de eficiência de créditos: 'para que possa aproveitar ainda mais os seus créditos'.

A empresa refere que 'foram gerados dezenas de milhões de vídeos no Flow' desde o lançamento em maio. Este é o único valor de utilização divulgado no anúncio, e vale a pena interpretá-lo como um indicador aproximado de escala e não como uma métrica precisa — mostra que a ferramenta tem tração, mas não quantifica utilizadores nem retenção.

A voz é a capacidade específica, e continua experimental

A distinção relevante aqui é entre áudio ambiente e diálogo. Adicionar efeitos sonoros e ruído de fundo a um clip gerado é um problema de textura; gerar voz associada a um frame inicial é um problema de sincronização e inteligibilidade. A Google é explícita ao afirmar que ainda não o resolveu por completo.

A geração de áudio no Flow continua experimental e estamos a continuar a melhorá-la, por isso os resultados podem variar. Montana Labs

Essa ressalva é o núcleo honesto deste lançamento. A geração de voz sobre uma imagem fornecida pelo utilizador é exactamente o tipo de funcionalidade em que os resultados se degradam de forma imprevisível — o alinhamento labial, o tom e o timing têm de se manter coerentes face a um frame que o modelo não criou. Lançá-la classificada como experimental é a decisão correta, e as equipas que estão a avaliar o Flow devem tratar a voz gerada como um mecanismo de rascunho, e não como um mecanismo de render final.

A expansão geográfica é o movimento estrutural mais relevante

Paralelamente à funcionalidade, a Google expandiu o Flow e o plano Google AI Ultra a mais 76 países, levando o Flow a mais de 140 países para subscritores do Google AI Pro ou Ultra. Em termos numéricos, esta alteração na distribuição chega a mais pessoas do que a funcionalidade de voz — o acesso é a barreira, e a Google acabou de a alargar substancialmente.

As notas de rodapé importam aqui mais do que o habitual. A Google alerta que 'a disponibilidade das funcionalidades do produto pode variar de acordo com o país de utilização' e que 'certos tipos de imagem podem não ser suportados'. Assim, o número de 140 países representa um teto para a presença do Flow, não uma garantia de que a geração de voz ou o Frames to Video funcionam de forma idêntica em todos os mercados. Quem planear com base nisto deve verificar a funcionalidade específica no mercado específico, em vez de assumir paridade.

O que esta combinação sinaliza para quem constrói sobre vídeo generativo

A combinação — uma funcionalidade de diálogo experimental associada a uma ampla expansão de disponibilidade — sugere que a Google está, nesta fase, a priorizar o alcance em detrimento do acabamento. Está a colocar simultaneamente em dezenas de novos mercados uma capacidade que assume poder 'variar', ao mesmo tempo que promove o caminho mais económico do Veo 3 Fast para que os créditos rendam mais. Para equipas aplicadas, a implicação prática é construir fluxos de trabalho que tolerem variação: utilizar a voz gerada pelo Flow em contextos onde uma pessoa revê e regenera os clips, condicionar o acesso a verificações específicas por país, e prever no orçamento as diferenças de créditos entre o Veo 3 e o Veo 3 Fast, em vez de assumir um perfil de custo único em toda a nova área de cobertura.

Find this story relevant to you?

Contact us to find a unique solution

Contact us

Precisa de um parceiro de engenharia de IA que saiba executar?

Ajudamos equipas em Portugal a integrar IA em produtos, automatizar processos de alto valor e modernizar os sistemas que suportam o negocio.

Get in touch

Leitura relacionada

Mais análises sobre entrega de produto, AI operacional e o trabalho de sistemas que faz com que a implementação funcione na prática.

Jul, 13 4 min de leitura
Produtos de AI

A ENEOS Materials criou mais de 1000 GPTs personalizados e disponibilizou o ChatGPT Enterprise a todos os colaboradores

Jul, 9 4 min de leitura
Produtos de AI

OpenAI propõe um instituto internacional de segurança AI para jovens antes da Cimeira do G7 em Évian

Jul, 9 4 min de leitura
Produtos de AI

O GPT-5.5 Instant da OpenAI é o primeiro modelo Instant classificado com risco elevado em cibersegurança e biologia