Inteligência Artificial

IA é capaz de ouvir e falar simultaneamente; saiba mais

Publicado por
Isabella Caminoto

Pesquisadores de inteligência artificial (IA) desenvolveram um novo Modelo de Linguagem de Escuta Enquanto Fala (LSLM) capaz de ouvir e falar simultaneamente, avançando nas conversas baseadas em voz em tempo real e interativas.

O novo modelo, chamado LSLM, permite modelagem full-duplex em modelos de linguagem e fala interativos. O LSLM utiliza um decodificador baseado em tokens apenas para geração de fala e um codificador de aprendizado autosupervisionado em streaming para entrada de áudio em tempo real.

O sistema pode detectar troca de turnos em tempo real e responder a interrupções, uma característica fundamental de uma conversa natural. O modelo demonstrou robustez ao ruído e sensibilidade a instruções diversas em experimentos.

Enquanto o recente modo de voz avançado Her-like da OpenAI para o ChatGPT nos aproxima de conversas de IA realistas, o LSLM avança ainda mais, permitindo que a IA processe a fala de entrada enquanto fala. Isso pode revolucionar as interações humano-IA, tornando as conversas com máquinas verdadeiramente naturais e responsivas.

Leia também:

Este post foi modificado pela última vez em %s = human-readable time difference 11:45

Isabella Caminoto

Advogada e mestranda em Direito Internacional, tenho a democracia e a liberdade como bandeiras irrenunciáveis. Sou apaixonada pelos animais e acredito que o bem-estar do nosso planeta deveria ser o destaque diário da pauta da nossa sociedade.

Posts recentes

Google se associa à Apptronik para desenvolver robôs humanoides

O Google DeepMind acaba de anunciar uma parceria estratégica com a Apptronik, uma empresa de…

20 de dezembro de 2024

Genesis: Um novo patamar para simulações físicas em IA

Uma equipe de pesquisadores de 20 laboratórios diferentes acaba de apresentar o Genesis, um motor…

20 de dezembro de 2024

Google lança seu próprio modelo de IA de “raciocínio”

O Google acabou de lançar o que está chamando de um novo modelo de inteligência…

19 de dezembro de 2024

GitHub Copilot agora é gratuito

A GitHub, de propriedade da Microsoft, acaba de anunciar um nível gratuito de seu Copilot…

19 de dezembro de 2024

ChatGPT ganha um novo número de telefone; veja

A OpenAI acaba de lançar uma nova maneira surpreendente de acessar o ChatGPT - através…

19 de dezembro de 2024

Google lança novo benchmark para testar a factualidade de LLMs

O Google DeepMind acaba de lançar o FACTS Grounding, um novo benchmark projetado para avaliar…

18 de dezembro de 2024