Inteligência Artificial

Salesforce avança em modelos compactos; saiba mais

Publicado por
Isabella Caminoto

A Salesforce acaba de publicar uma nova pesquisa sobre o APIGen, um sistema automatizado que gera conjuntos de dados ideais para o treinamento de inteligência artificial (IA) em tarefas de chamada de função. Isso permitiu que o modelo xLAM da empresa superasse rivais muito maiores.

Entenda a inovação:
  • O APIGen foi criado para treinar modelos em conjuntos de dados que refletem melhor a complexidade real do uso de APIs (interfaces de programação de aplicativos).
  • A Salesforce treinou versões do xLAM com 7 bilhões e 1 bilhão de parâmetros usando o APIGen, testando-as em benchmarks de chamada de função.
  • O modelo xLAM de 7 bilhões de parâmetros ficou em 6º lugar entre 46 modelos, igualando ou superando rivais 10 vezes maiores, incluindo o GPT-4.
  • O “Tiny Giant” xLAM de 1 bilhão de parâmetros superou modelos como Claude Haiku e GPT-3.5, com o CEO Mark Benioff chamando-o de o melhor “micro-modelo” para chamada de função.
Por que isso é importante:

A corrida da IA tem se concentrado em construir modelos cada vez maiores. A abordagem da Salesforce sugere que a curadoria inteligente de dados pode levar a sistemas mais eficientes. A pesquisa também é um grande passo em direção a uma IA on-device (em dispositivos) mais autônoma, concentrando o poder de modelos grandes em um formato compacto.

Leia também:

Este post foi modificado pela última vez em %s = human-readable time difference 14:48

Isabella Caminoto

Advogada e mestranda em Direito Internacional, tenho a democracia e a liberdade como bandeiras irrenunciáveis. Sou apaixonada pelos animais e acredito que o bem-estar do nosso planeta deveria ser o destaque diário da pauta da nossa sociedade.

Posts recentes

DeepMind dá um salto gigante na computação quântica com o AlphaQubit

O Google DeepMind acaba de apresentar o AlphaQubit, um sistema de inteligência artificial (IA) que…

21 de novembro de 2024

ChatGPT está mais perto de lançar sua IA visual

Um código recém-descoberto na última versão beta do ChatGPT sugere que a OpenAI pode estar…

21 de novembro de 2024

DeepSeek revela poderosa IA de raciocínio; veja

A empresa chinesa de pesquisa em inteligência artificial (IA), DeepSeek, acaba de lançar o R1-Lite-Preview,…

21 de novembro de 2024

OpenAI lança curso gratuito de IA para professores

A OpenAI e a parceira sem fins lucrativos Common Sense Media lançaram um curso de…

20 de novembro de 2024

Robôs da Figure transformam produção da BMW; saiba como

Brett Adcock, CEO da Figure, postou uma atualização sobre os robôs humanoides da empresa trabalhando…

20 de novembro de 2024

Microsoft revela agentes de IA especializados e ferramentas de automação

A Microsoft acaba de apresentar uma suíte de novos agentes de inteligência artificial (IA) especializados…

20 de novembro de 2024