Inteligência Artificial

AI2 lança OLMo 2: Novo modelo de linguagem de código aberto desafia o Llama

Publicado por
Isabella Caminoto

O instituto de pesquisa AI2 acaba de lançar o OLMo 2, uma nova família de modelos de linguagem totalmente de código aberto que iguala o desempenho de concorrentes de tamanho semelhante, como o Llama da Meta.

Detalhes do lançamento
  • Os modelos 7B e 13B foram treinados em um conjunto de dados de 5T tokens de conteúdo acadêmico de alta qualidade, dados da web filtrados e fontes de instruções especializadas.
  • Os modelos OLMo alcançaram resultados semelhantes ou melhores, usando menos poder de computação do que os concorrentes e sendo menores em tamanho.
  • Os modelos são totalmente abertos, com a AI2 fornecendo acesso ao código-fonte, dados de treinamento e um pacote de desenvolvimento com receitas de treinamento e frameworks de avaliação.
  • O lançamento também inclui variantes ajustadas por instruções, que alcançam resultados competitivos com modelos abertos líderes, como o Qwen 2.5.
Por que isso importa

Enquanto outros modelos de código aberto lançam pesos, mas permanecem fortemente guardados, o OLMo 2 prova que a inteligência artificial (IA) de ponta pode ser desenvolvida e lançada completamente em aberto – potencialmente estabelecendo um novo padrão poderoso para como sistemas futuros são construídos e compartilhados.

Leia também:

Este post foi modificado pela última vez em %s = human-readable time difference 12:45

Isabella Caminoto

Advogada e mestranda em Direito Internacional, tenho a democracia e a liberdade como bandeiras irrenunciáveis. Sou apaixonada pelos animais e acredito que o bem-estar do nosso planeta deveria ser o destaque diário da pauta da nossa sociedade.

Posts recentes

Arizona aposta em IA para substituir professores em sala de aula

O Arizona aprovou um programa escolar revolucionário, porém controverso, onde a inteligência artificial (IA) -…

3 de janeiro de 2025

IA da Stanford cria avatares digitais com gestos mais humanos; veja

Pesquisadores da Stanford desenvolveram um modelo de inteligência artificial (IA) que permite que avatares digitais…

2 de janeiro de 2025

DeepSeek-V3 reescreve o playbook da IA de código aberto

A startup chinesa de inteligência artificial (IA) DeepSeek acaba de lançar o DeepSeek-V3, um novo…

1 de janeiro de 2025

ChatGPT sob ataque: Vulnerabilidade expõe riscos da busca por IA

A nova funcionalidade de busca do ChatGPT, a poderosa ferramenta de inteligência artificial (IA) da…

30 de dezembro de 2024

OpenAI apresenta plano para se tornar uma empresa com fins lucrativos

A OpenAI divulgou um plano para reformular sua estrutura corporativa no próximo ano, afirmando que…

27 de dezembro de 2024

Apple se aproxima de US$ 4 trilhões de valor de mercado impulsionada pela IA

A Apple está se aproximando de uma marca histórica de US$ 4 trilhões de valor…

26 de dezembro de 2024