Inteligência Artificial

V2A: Google DeepMind cria som para vídeos

Publicado por
Isabella Caminoto

A DeepMind, laboratório de pesquisa do Google, publicou um novo estudo sobre seu sistema de IA V2A (vídeo para áudio). O V2A gera trilhas sonoras detalhadas e sincronizadas para vídeos, incluindo música, efeitos sonoros, diálogos e muito mais.

Como funciona o V2A

O V2A combina pixels brutos de vídeo com descrições textuais para produzir áudio realista que corresponda ao que se vê na tela e ao tom do vídeo. O modelo foi treinado em vídeo, áudio, anotações de efeitos sonoros e transcrições de fala para aprender a associar eventos visuais e sonoros.

O futuro do V2A

A DeepMind afirma estar testando o V2A com renomados cineastas e planeja realizar mais testes de segurança antes de disponibilizá-lo ao público.

Por que isso é importante

Enquanto a geração de vídeo por inteligência artificial (IA) avança rapidamente, os resultados geralmente são perturbadoramente silenciosos. A integração do V2A com modelos como o Veo (também do Google) pode levar a capacidades criativas a um novo patamar, permitindo que diálogos, efeitos sonoros e música sejam facilmente combinados com a produção de vídeo.

Leia também:

Este post foi modificado pela última vez em %s = human-readable time difference 12:34

Isabella Caminoto

Advogada e mestranda em Direito Internacional, tenho a democracia e a liberdade como bandeiras irrenunciáveis. Sou apaixonada pelos animais e acredito que o bem-estar do nosso planeta deveria ser o destaque diário da pauta da nossa sociedade.

Posts recentes

Google se associa à Apptronik para desenvolver robôs humanoides

O Google DeepMind acaba de anunciar uma parceria estratégica com a Apptronik, uma empresa de…

20 de dezembro de 2024

Genesis: Um novo patamar para simulações físicas em IA

Uma equipe de pesquisadores de 20 laboratórios diferentes acaba de apresentar o Genesis, um motor…

20 de dezembro de 2024

Google lança seu próprio modelo de IA de “raciocínio”

O Google acabou de lançar o que está chamando de um novo modelo de inteligência…

19 de dezembro de 2024

GitHub Copilot agora é gratuito

A GitHub, de propriedade da Microsoft, acaba de anunciar um nível gratuito de seu Copilot…

19 de dezembro de 2024

ChatGPT ganha um novo número de telefone; veja

A OpenAI acaba de lançar uma nova maneira surpreendente de acessar o ChatGPT - através…

19 de dezembro de 2024

Google lança novo benchmark para testar a factualidade de LLMs

O Google DeepMind acaba de lançar o FACTS Grounding, um novo benchmark projetado para avaliar…

18 de dezembro de 2024