A Nvidia acaba de lançar o Nemotron-4 340B, uma família de modelos de linguagem open-source projetados para gerar dados sintéticos de treinamento de alta qualidade e construir aplicações de inteligência artificial (IA) poderosas em diversos setores.
Os três modelos (Base, Instruct e Reward) formam um “pipeline” para criar dados sintéticos para treinar novos e poderosos LLMs (Modelos de Linguagem Grande, na sigla em inglês).
Os modelos Nemotron-4 igualam ou superam concorrentes open-source como Llama-3, Mixtral e Qwen-2 em uma variedade de benchmarks.
Além disso, a Nvidia também lançou o Mamba-2 Hybrid, um modelo seletivo de espaço de estado (SSM) que superou em precisão LLMs baseados em transformadores similares.
A Nvidia acaba de disponibilizar gratuitamente uma família de modelos open-source que não apenas corresponde aos recursos de alguns dos principais concorrentes da área, mas também se destaca na criação de dados sintéticos necessários para continuar aprimorando novos LLMs. A gigante fabricante de chips é uma potência de IA com muitos talentos.
Leia também:
Este post foi modificado pela última vez em 17 de junho de 2024 09:52
A Bloomberg News informou nesta segunda-feira (24), citando fontes familiarizadas com o assunto, que a…
A inteligência artificial (IA) tem revolucionado diversos setores - desde a saúde até o entretenimento…
Immersity AI é uma plataforma avançada que transforma imagens e vídeos 2D em experiências 3D…
A Fórmula 1 estreou no Grande Prêmio da Espanha um novo recurso de inteligência artificial…
Empresas de tecnologia globais e startups locais estão desenvolvendo assistentes virtuais e chatbots com inteligência…
Segundo o Wall Street Journal, Meta e Apple estão negociando uma parceria para integrar o…