Inteligência Artificial

Nova estrutura de IA otimiza o uso de LLM; saiba mais

Publicado por
Isabella Caminoto

Pesquisadores da Lmsys publicaram recentemente um estudo detalhando o RouteLLM, uma estrutura de código aberto para roteamento econômico entre grandes modelos de linguagem (LLM).

O RouteLLM aprende a direcionar consultas entre um LLM mais poderoso e caro e um LLM mais fraco e barato, para otimizar custo e desempenho. O sistema funciona como um filtro, usando dados de preferência humana para determinar o roteamento correto de cada mensagem para o LLM mais adequado.

Em testes roteando consultas entre o GPT-4 e o Mixtral-8x7B, o RouteLLM alcançou economias significativas de custo, mantendo 95% do desempenho do GPT-4.

Por que isso importa

À medida que os LLMs se tornam mais poderosos, o roteamento inteligente pode ajudar a reduzir significativamente os custos, muitas vezes altos, mantendo a qualidade das saídas. No futuro, roteadores também podem ser usados para filtrar consultas de usuários para os LLMs mais capacitados ou especializados, aproveitando os pontos fortes e fracos de diferentes modelos.

Leia também:

Este post foi modificado pela última vez em %s = human-readable time difference 16:04

Isabella Caminoto

Advogada e mestranda em Direito Internacional, tenho a democracia e a liberdade como bandeiras irrenunciáveis. Sou apaixonada pelos animais e acredito que o bem-estar do nosso planeta deveria ser o destaque diário da pauta da nossa sociedade.

Posts recentes

Google se associa à Apptronik para desenvolver robôs humanoides

O Google DeepMind acaba de anunciar uma parceria estratégica com a Apptronik, uma empresa de…

20 de dezembro de 2024

Genesis: Um novo patamar para simulações físicas em IA

Uma equipe de pesquisadores de 20 laboratórios diferentes acaba de apresentar o Genesis, um motor…

20 de dezembro de 2024

Google lança seu próprio modelo de IA de “raciocínio”

O Google acabou de lançar o que está chamando de um novo modelo de inteligência…

19 de dezembro de 2024

GitHub Copilot agora é gratuito

A GitHub, de propriedade da Microsoft, acaba de anunciar um nível gratuito de seu Copilot…

19 de dezembro de 2024

ChatGPT ganha um novo número de telefone; veja

A OpenAI acaba de lançar uma nova maneira surpreendente de acessar o ChatGPT - através…

19 de dezembro de 2024

Google lança novo benchmark para testar a factualidade de LLMs

O Google DeepMind acaba de lançar o FACTS Grounding, um novo benchmark projetado para avaliar…

18 de dezembro de 2024