Inteligência Artificial

Nvidia lança novos modelos de IA de código aberto; confira

Publicado por
Isabella Caminoto

A Nvidia acaba de lançar o Nemotron-4 340B, uma família de modelos de linguagem open-source projetados para gerar dados sintéticos de treinamento de alta qualidade e construir aplicações de inteligência artificial (IA) poderosas em diversos setores.

Como funciona

Os três modelos (Base, Instruct e Reward) formam um “pipeline” para criar dados sintéticos para treinar novos e poderosos LLMs (Modelos de Linguagem Grande, na sigla em inglês).

  • O Instruct cria dados sintéticos de treinamento de alta qualidade (e foi treinado em 98% de dados sintéticos),
  • enquanto o Reward filtra os dados para encontrar os exemplos de melhor qualidade.

Os modelos Nemotron-4 igualam ou superam concorrentes open-source como Llama-3, Mixtral e Qwen-2 em uma variedade de benchmarks.

Além disso, a Nvidia também lançou o Mamba-2 Hybrid, um modelo seletivo de espaço de estado (SSM) que superou em precisão LLMs baseados em transformadores similares.

Porque isso é importante

A Nvidia acaba de disponibilizar gratuitamente uma família de modelos open-source que não apenas corresponde aos recursos de alguns dos principais concorrentes da área, mas também se destaca na criação de dados sintéticos necessários para continuar aprimorando novos LLMs. A gigante fabricante de chips é uma potência de IA com muitos talentos.

Leia também:

Este post foi modificado pela última vez em %s = human-readable time difference 09:52

Isabella Caminoto

Advogada e mestranda em Direito Internacional, tenho a democracia e a liberdade como bandeiras irrenunciáveis. Sou apaixonada pelos animais e acredito que o bem-estar do nosso planeta deveria ser o destaque diário da pauta da nossa sociedade.

Posts recentes

Google se associa à Apptronik para desenvolver robôs humanoides

O Google DeepMind acaba de anunciar uma parceria estratégica com a Apptronik, uma empresa de…

20 de dezembro de 2024

Genesis: Um novo patamar para simulações físicas em IA

Uma equipe de pesquisadores de 20 laboratórios diferentes acaba de apresentar o Genesis, um motor…

20 de dezembro de 2024

Google lança seu próprio modelo de IA de “raciocínio”

O Google acabou de lançar o que está chamando de um novo modelo de inteligência…

19 de dezembro de 2024

GitHub Copilot agora é gratuito

A GitHub, de propriedade da Microsoft, acaba de anunciar um nível gratuito de seu Copilot…

19 de dezembro de 2024

ChatGPT ganha um novo número de telefone; veja

A OpenAI acaba de lançar uma nova maneira surpreendente de acessar o ChatGPT - através…

19 de dezembro de 2024

Google lança novo benchmark para testar a factualidade de LLMs

O Google DeepMind acaba de lançar o FACTS Grounding, um novo benchmark projetado para avaliar…

18 de dezembro de 2024