Stability AI lança ferramenta de IA que gera música a partir de prompts de texto; conheça o Stable Audio

A Stability AI, empresa de inteligência artificial por trás do Stable Diffusion, anunciou nesta quarta (13) o lançamento de seu produto inaugural de IA para geração de música e som, o Stable Audio. O produto é voltado para usuários que buscam criar amostras para suas músicas e faixas de áudio.

Publicado por

Uesley Durães

13 de setembro de 2023 13:21

Com o Stable Audio, os usuários podem inserir prompts de texto para gerar faixas de áudio com o comprimento desejado. Por exemplo, um usuário pode inserir “Pós-Rock, Guitarras, Kit de Bateria, Baixo, Cordas, Sentimental, 125 BPM” para gerar uma faixa de 95 segundos de música pós-rock com um clima eufórico.

Veja um exemplo de áudio criado com a ferramenta:

De acordo com o comunicado oficial de lançamento, o modelo fundamental do Stable Audio foi treinado usando músicas e metadados da AudioSparx, uma biblioteca de músicas. A empresa alega que o modelo é capaz de renderizar 95 segundos de áudio estéreo a uma taxa de amostragem de 44,1 kHz em menos de um segundo em uma GPU NVIDIA A100.

O Stable Audio é baseado em uma arquitetura de difusão latente que compreende vários componentes, incluindo um codificador automático variacional (VAE), um codificador de texto e um modelo de difusão condicionado baseado em U-Net.

Técnicamente, a plataforma funciona dessa forma (reprodução Stability)

O VAE transforma o áudio estéreo em uma codificação latente compacta, resistente ao ruído e reversível com perda. Essa codificação facilita a geração e o treinamento mais rápidos em comparação com o trabalho direto com amostras de áudio bruto.

A arquitetura de difusão latente aproveita os dados de áudio, levando em consideração os metadados do texto, a duração do arquivo de áudio e a hora de início. Essa abordagem permite o controle do conteúdo e da duração do áudio gerado.

O Stable Audio está disponível em duas versões: uma versão gratuita com recursos limitados e uma versão Pro com recursos estendidos. A versão Pro oferece faixas estendidas de 90 segundos, adequadas para projetos comerciais.

“Esperamos que o Stable Audio capacite entusiastas da música e profissionais criativos para gerar novo conteúdo com a ajuda da IA”, disse Emad Mostaque, CEO da Stability AI.

Veja também:

Stable Chat: chatbot promete ser mais eficiente que o ChatGPT

Stable Chat é um chatbot desenvolvido pela empresa de tecnologia StabilityAI. De acordo com a empresa, ele é projetado para ser mais confiável do que outros chatbots.

Stable Doodle: inteligência artificial que transforma desenhos simples em imagens realistas

A Stability AI, dona do Stable Diffusion, lançou na quinta (13) uma nova ferramenta de esboço para imagem chamada Stable Doodle. O Stable Doodle é uma ferramenta que permite a qualquer pessoa transformar um desenho simples em uma imagem realista e dinâmica, sem habilidades ou treinamento artístico.

Este post foi modificado pela última vez em 13 de setembro de 2023 14:00

Uesley Durães

Próximo Amazon divulga novas regras para livros Kindle gerados por IA »

Anterior « Mar mais quente e caos político provocaram desastre na Líbia, dizem especialistas

Compartilhar

Publicado por

Uesley Durães

Tags: áudiointeligência artificialStable

13 de setembro de 2023 13:21

Posts recentes

Inteligência Artificial

Quando a IA afasta o médico do paciente: o novo desafio do diagnóstico à beira do leito

A inteligência artificial (IA) está transformando rapidamente a medicina. Sistemas capazes de analisar exames de…

24 de julho de 2026

Inteligência Artificial

OMS reúne 37 países para definir regras globais sobre inteligência artificial na saúde

A Organização Mundial da Saúde reuniu ministros, autoridades governamentais e especialistas de 37 países em…

15 de julho de 2026

Inteligência Artificial

IA promete eficiência na saúde, mas Harvard alerta para risco de desumanização do cuidado

A inteligência artificial (IA) já começa a transformar hospitais, consultórios e sistemas de saúde, assumindo…

10 de julho de 2026

Inteligência Artificial

GPT-5.6: OpenAI apresenta sua IA mais poderosa, mas restringe acesso a poucos parceiros

A OpenAI apresentou oficialmente o GPT-5.6, sua mais nova geração de modelos de inteligência artificial…

29 de junho de 2026

Inteligência Artificial

OpenAI entra na guerra dos chips e desafia Nvidia e Google na corrida pela infraestrutura da IA; conheça o Jalapeño

A OpenAI deu um passo que pode redefinir o equilíbrio de poder no setor de…

25 de junho de 2026

Inteligência Artificial

OpenAI ajuda a desvendar doenças raras infantis e dá nova esperança a casos sem diagnóstico

Um dos maiores desafios da medicina moderna está nos chamados "casos sem resposta": pacientes que…

23 de junho de 2026