Conheça o LLaMA 2 e o que difere o modelo de linguagem de outros já lançados

A Meta anunciou nesta semana o lançamento do LLaMA 2, um grande modelo de linguagem de código aberto. O LLaMA 2 é treinado em um enorme conjunto de dados de texto e código. A empresa de Mark Zuckerberg pretende fazer frente a OpenAI com o lançamento. Entenda as diferenças.

Publicado por
Uesley Durães

De forma geral, o LLaMA pode gerar texto, traduzir idiomas, escrever diferentes tipos de conteúdo criativo e responder perguntas de forma informativa.

O LLaMA 2 foi treinado com 40% mais dados do que o LLaMA 1, e supera outros LLMs como Falcon e MPT quando se trata de testes de raciocínio, codificação, proficiência e conhecimento. 

Para Ricardo Bindi, pesquisador com formação em Ciências Moleculares e Neurociências, o Llama 2 supera outros modelos de linguagem de código aberto em muitos benchmarks externos, incluindo raciocínio, codificação, proficiência e testes de conhecimento. 

O modelo ajustado ao usuário direto, o Llama-2-chat, aproveita conjuntos de dados instrucionais disponíveis publicamente e mais de 1 milhão de anotações humanas.

Para quem deseja usar o modelo em outros projetos, com a API, o código aberto do LLaMA 2 está disponível na plataforma Azure da Microsoft, e também através da AWS, Hugging Face e outros provedores. 

De acordo com a Meta, foram enviados mais de 100 mil pedidos de pesquisadores para usar seu primeiro modelo, no entanto, há a expectativa que o LLaMA 2 de código aberto supere o número.

Como funciona o LLaMA 2?

O LLaMA 2 é um modelo de linguagem factual de grande escala, o que significa que ele é treinado em um enorme conjunto de dados de texto e código. Esse conjunto de dados inclui livros, artigos, códigos e outras formas de texto. 

O modelo é capaz de aprender as relações entre as palavras e os conceitos presentes no conjunto de dados, o que lhe permite gerar texto, traduzir idiomas, escrever diferentes tipos de conteúdo criativo e responder perguntas de forma informativa.

Meta lança LLaMa-2, um modelo de linguagem de grande escala que promete ser tão bom quanto o GPT

O que o LLaMA 2 pode fazer?

Baseado no informativo de imprensa da Meta, o modelo pode fazer uma série de coisas, incluindo:

  • Gerar texto: O LLaMA 2 pode gerar texto que é factualmente preciso e coeso. Ele pode ser usado para gerar diferentes tipos de texto, como artigos, e-mail, cartas, etc.
  • Traduzir idiomas: O LLaMA 2 pode traduzir idiomas de forma precisa e fluida. Ele pode ser usado para traduzir textos, sites, e-mail, etc.
  • Escrever diferentes tipos de conteúdo criativo: O LLaMA 2 pode escrever diferentes tipos de conteúdo criativo, como poemas, código, scripts, peças musicais, e-mail, cartas, etc.
  • Responder às suas perguntas de forma informativa: O LLaMA 2 pode responder às suas perguntas de forma abrangente e informativa, mesmo que sejam abertas, desafiadoras ou estranhas.

Como usar?

O LLaMA 2 é um modelo de código aberto, o que significa que está disponível para qualquer pessoa usar. Você pode usar o LLaMA 2 através da plataforma Azure da Microsoft, ou através de outros provedores como a AWS e a Hugging Face.

O objetivo da Meta oferecendo a ferramenta para desenvolvedores até a partir de plataformas de concorrentes, como a Microsoft, é bater de frente com a OpenAI, que viu seu modelo de linguagem se tornar o mais popular desde o lançamento no fim do ano passado. 

Veja também:

Este post foi modificado pela última vez em %s = human-readable time difference 15:55

Uesley Durães

Posts recentes

DeepMind dá um salto gigante na computação quântica com o AlphaQubit

O Google DeepMind acaba de apresentar o AlphaQubit, um sistema de inteligência artificial (IA) que…

21 de novembro de 2024

ChatGPT está mais perto de lançar sua IA visual

Um código recém-descoberto na última versão beta do ChatGPT sugere que a OpenAI pode estar…

21 de novembro de 2024

DeepSeek revela poderosa IA de raciocínio; veja

A empresa chinesa de pesquisa em inteligência artificial (IA), DeepSeek, acaba de lançar o R1-Lite-Preview,…

21 de novembro de 2024

OpenAI lança curso gratuito de IA para professores

A OpenAI e a parceira sem fins lucrativos Common Sense Media lançaram um curso de…

20 de novembro de 2024

Robôs da Figure transformam produção da BMW; saiba como

Brett Adcock, CEO da Figure, postou uma atualização sobre os robôs humanoides da empresa trabalhando…

20 de novembro de 2024

Microsoft revela agentes de IA especializados e ferramentas de automação

A Microsoft acaba de apresentar uma suíte de novos agentes de inteligência artificial (IA) especializados…

20 de novembro de 2024