Chameleon: O novo LLM multimodal da Meta

Publicado por

Isabella Caminoto

23 de maio de 2024 16:00

Chameleon: o novo LLM multimodal da Meta

O laboratório de pesquisa em IA da Meta acaba de apresentar o Chameleon, uma nova família de modelos de inteligência artificial (IA) baseados em tokens com “fusão antecipada”. O Chameleon consegue entender e gerar texto e imagens em qualquer sequência.

Segunda cúpula global de IA garante compromissos de segurança de empresas

Diferente de outros modelos que processam imagens e textos separadamente, combinando-os depois, o Chameleon trabalha com sequências vinculadas de ambos. O Chameleon superou todos os modelos concorrentes em legendagem de imagens e perguntas visuais, e ainda assim manteve um desempenho equivalente em tarefas somente com texto. O Chameleon, com seus 34 bilhões de parâmetros, também igualou ou superou modelos top como o Gemini Pro e o GPT-4V em testes de geração multimodal de longa duração.

Por que isso importa

O Chameleon demonstra o potencial de uma arquitetura diferente para modelos de IA multimodais. Sua abordagem de fusão antecipada permite um raciocínio e geração mais fluidos entre diferentes modalidades, estabelecendo novos patamares de performance.

Leia também:

Humane busca por comprador após lançamento do AI Pin

Este post foi modificado pela última vez em %s = human-readable time difference 13:43

Isabella Caminoto

Advogada e mestranda em Direito Internacional, tenho a democracia e a liberdade como bandeiras irrenunciáveis. Sou apaixonada pelos animais e acredito que o bem-estar do nosso planeta deveria ser o destaque diário da pauta da nossa sociedade.